Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Verglichene Modelle

Benchmark-Vergleich Qwen3.5 Plus 2026-02-15 (medium) vs Qwen3.6 Plus Preview (medium) vs GLM 5 Turbo (medium): GLM 5 Turbo (medium) führt bei Punktzahl mit 7.6. Qwen3.5 Plus 2026-02-15 (medium) führt bei Zuverlässigkeit mit 10.0. Qwen3.6 Plus Preview (medium) hat den niedrigsten Gesamtkosten mit $0.000. Qwen3.6 Plus Preview (medium) ist mit 15.25s am schnellsten.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-14

Rang
#87
Gesamte Ausgabe-Token
260,704
Antwortzeit (Durchschnitt)
89.19s
Gesamtkosten
$0.437
Rang
#236
Gesamte Ausgabe-Token
63,350
Antwortzeit (Durchschnitt)
15.25s
Gesamtkosten
$0.000
Rang
#78
Gesamte Ausgabe-Token
74,522
Antwortzeit (Durchschnitt)
23.00s
Gesamtkosten
$0.323
Empfohlenes Modell GLM 5 Turbo (medium)

Es hat hier die beste Punktzahl (7.6) und antwortet etwa 2.3x schneller als die anderen Modelle in diesem Vergleich.

Detaillierter Vergleich

Metrik Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Veröffentlichung: 2026-02-15 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Veröffentlichung: 2026-04-20 Kostenlos verfügbar GLM 5 Turbo GLM 5 Turbo medium Veröffentlichung: 2026-03-15
Punktzahl 7.5 4.9 7.6
Rang #87 #236 #78
Zuverlässigkeit 10.0 k. A. 10.0
Konsistenz 8.5 8.6 8.1
Versuche 66/66 57/66 63/66
Korrekte Tests
Erfolgsquote pro Versuch 71.2% 40.9% 71.2%
Instabile Tests 4 0 4
Gesamtläufe 66 57 63
Kosten pro Ergebnis 3.348 0.000 2.011
Gesamtkosten $0.437 $0.000 $0.323
Eingabepreis $0.260 / 1M $0.000 / 1M $1.200 / 1M
Ausgabepreis $1.560 / 1M $0.000 / 1M $4.000 / 1M
Gesamte Eingabe-Token 113,560 32,639 35,593
Ausgabe-Token 9,823 1,153 12,245
Denk-Token 250,881 62,197 62,277
Antwortzeit (Durchschnitt) 89.19s 15.25s 23.00s
Antwortzeit (Maximum) 304.85s 43.55s 194.23s
Antwortzeit (Gesamt) 1337.92s 182.96s 482.97s
Parameter ~397B insgesamt (~17B aktiv) ~397B insgesamt (~17B aktiv) 744B insgesamt (40B aktiv)
Verfügbarkeit Geschlossen Geschlossen Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#87 Qwen3.5 Plus 2026-02-15

medium
Kosten
$0.011
Zeit
125.5s
Token
7,040 tok

#236 Qwen3.6 Plus Preview

medium
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
Kosten
$0.000
Zeit
-
Token
0 tok

#78 GLM 5 Turbo

medium
Kosten
$0.074
Zeit
206.0s
Token
18,549 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0
GLM 5 Turbo 8.2 9.3 66.7% 0 45.90s 5,941 363 25,381

Schnellvergleich

Vergleichspaar wechseln