Navigation
AI BENCHY
Advertise here

Inception: Mercury 2 vs Z.ai: GLM 4.7 Flash

Mercury 2 führt beim Durchschnittsscore mit 4.6 vs 4.3. Mercury 2 hat die niedrigeren Benchmark-Kosten mit $0.030 vs $0.166. Mercury 2 ist schneller mit 829ms vs 142.59s, mit Erfolgsraten von 22.7% vs 31.8%.

Empfohlenes ModellMercury 2Es hat hier die beste Punktzahl (4.6) und kostet etwa 5.7x weniger als GLM 4.7 Flash (medium).

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-18

Metrik Mercury 2 Mercury 2 none Veröffentlichung: 2026-02-24 GLM 4.7 Flash GLM 4.7 Flash medium Veröffentlichung: 2026-01-19
Punktzahl 4.6 4.3
Rang #185 #190
Zuverlässigkeit 10.0 7.8
Konsistenz 9.2 7.0
Korrekte Tests
Erfolgsquote pro Versuch 22.7% 31.8%
Instabile Tests 2 8
Gesamtläufe 66 66
Kosten pro Ergebnis 0.734 4.147
Gesamtkosten $0.030 $0.166
Eingabepreis $0.250 / 1M $0.061 / 1M
Ausgabepreis $0.750 / 1M $0.400 / 1M
Gesamte Eingabe-Token 88,704 79,051
Ausgabe-Token 9,564 43,754
Denk-Token 0 374,109
Antwortzeit (Durchschnitt) 829ms 142.59s
Antwortzeit (Maximum) 4.52s 1539.97s
Antwortzeit (Gesamt) 18.24s 1996.21s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#185 Mercury 2

none
Kosten
$0.002
Zeit
1.8s
Token
1,514 tok

#190 GLM 4.7 Flash

medium
Ungültiges SVG
Kosten
$0.000
Zeit
186.2s
Token
12,112 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

Schnellvergleich

Vergleichspaar wechseln