Navigation
AI BENCHY
Advertise here

Verglichene Modelle

Benchmark-Vergleich GLM 5 (medium) vs GLM 5.1 (medium) vs Kimi K2.5 (medium) vs Qwen3.6 Plus Preview (medium): GLM 5 (medium) führt bei Punktzahl mit 7.7. GLM 5 (medium) führt bei Zuverlässigkeit mit 10.0. Qwen3.6 Plus Preview (medium) hat den niedrigsten Gesamtkosten mit $0.000. Qwen3.6 Plus Preview (medium) ist mit 15.25s am schnellsten.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-07-25

Rang
#49
Gesamte Ausgabe-Token
124,566
Antwortzeit (Durchschnitt)
33.54s
Gesamtkosten
$0.307
Rang
#82
Gesamte Ausgabe-Token
152,552
Antwortzeit (Durchschnitt)
46.77s
Gesamtkosten
$0.535
Rang
#85
Gesamte Ausgabe-Token
227,367
Antwortzeit (Durchschnitt)
99.00s
Gesamtkosten
$0.600
Rang
#190
Gesamte Ausgabe-Token
63,350
Antwortzeit (Durchschnitt)
15.25s
Gesamtkosten
$0.000
Empfohlenes Modell GLM 5 (medium)

Es hat hier die beste Punktzahl (7.7) und kostet etwa 1.8x weniger als die anderen Modelle in diesem Vergleich.

Detaillierter Vergleich

Metrik GLM 5 GLM 5 medium Veröffentlichung: 2026-02-12 GLM 5.1 GLM 5.1 medium Veröffentlichung: 2026-04-07 Kimi K2.5 Kimi K2.5 medium Veröffentlichung: 2026-01-27 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Veröffentlichung: 2026-04-20 Kostenlos verfügbar
Punktzahl 7.7 7.1 7.0 4.9
Rang #49 #82 #85 #190
Zuverlässigkeit 10.0 8.3 10.0 k. A.
Konsistenz 8.1 8.4 7.0 8.6
Korrekte Tests
Erfolgsquote pro Versuch 78.8% 69.7% 65.2% 40.9%
Instabile Tests 4 4 8 0
Gesamtläufe 63 66 66 57
Kosten pro Ergebnis 1.668 4.202 4.789 0.000
Gesamtkosten $0.307 $0.535 $0.600 $0.000
Eingabepreis $0.950 / 1M $0.966 / 1M $0.571 / 1M $0.000 / 1M
Ausgabepreis $2.551 / 1M $3.036 / 1M $2.850 / 1M $0.000 / 1M
Gesamte Eingabe-Token 35,224 82,623 118,448 32,639
Ausgabe-Token 21,570 16,089 62,124 1,153
Denk-Token 102,996 136,463 165,243 62,197
Antwortzeit (Durchschnitt) 33.54s 46.77s 99.00s 15.25s
Antwortzeit (Maximum) 99.85s 308.75s 281.00s 43.55s
Antwortzeit (Gesamt) 435.99s 982.16s 1485.04s 182.96s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium
Kosten
$0.005
Zeit
20.7s
Token
2,068 tok

#82 GLM 5.1

medium
Ungültiges SVG
Kosten
$0.000
Zeit
300.0s
Token
0 tok

#85 MoonshotAI: Kimi K2.5

medium
Kosten
$0.030
Zeit
58.6s
Token
8,683 tok

#190 Qwen3.6 Plus Preview

medium
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
Kosten
$0.000
Zeit
-
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0

Schnellvergleich

Vergleichspaar wechseln