Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 Flash Next (xhigh) vs GLM 5 (medium)

GLM 5 (medium) führt beim Durchschnittsscore mit 7.2 vs 7.1. Qwen3.8 Flash Next (xhigh) hat die niedrigeren Benchmark-Kosten mit ~$0.195 vs $0.479. GLM 5 (medium) ist schneller mit 39.05s vs 102.66s, mit Erfolgsraten von 72.5% vs 76.8%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#154
Gesamte Ausgabe-Token
621,056
Antwortzeit (Durchschnitt)
102.66s
Gesamtkosten
~$0.195
Rang
#150
Gesamte Ausgabe-Token
138,257
Antwortzeit (Durchschnitt)
39.05s
Gesamtkosten
$0.479
Empfohlenes Modell Qwen3.8 Flash Next (xhigh)

Die Punktzahl bleibt nah an der besten hier (7.1 vs 7.2) und es kostet etwa 2.5x weniger als GLM 5 (medium).

Detaillierter Vergleich

Metrik Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Veröffentlichung: 2026-10-04 GLM 5 GLM 5 medium Veröffentlichung: 2026-02-12
Punktzahl 7.1 7.2
Rang #154 #150
Zuverlässigkeit 9.9 10.0
Konsistenz 7.9 7.9
Versuche 69/69 66/69
Korrekte Tests
Erfolgsquote pro Versuch 72.5% 76.8%
Instabile Tests 6 5
Gesamtläufe 69 66
Kosten pro Ergebnis ~1.390 2.552
Gesamtkosten ~$0.195 $0.479
Eingabepreis k. A. $0.600 / 1M
Ausgabepreis k. A. $1.920 / 1M
Preis für Cache-Lesen k. A. $0.120 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 301,749 212,440
Ausgabe-Token 1,033 22,922
Denk-Token 620,023 115,335
Antwortzeit (Durchschnitt) 102.66s 39.05s
Antwortzeit (Maximum) 674.08s 110.70s
Antwortzeit (Gesamt) 2361.10s 546.68s
Parameter 180B insgesamt (6B aktiv) 744B insgesamt (40B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.8 Flash Next

xhigh
Kosten
~$0.010
Zeit
333.1s
Token
30,654 tok

#150 GLM 5

medium
Kosten
$0.005
Zeit
20.7s
Token
2,068 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

Schnellvergleich

Vergleichspaar wechseln

Step 3.7 FlashlowvsGLM 5mediumQwen3.7 FlashhighvsGLM 5mediumClaude Opus 5nonevsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumGemini 3.8 FlashlowvsGLM 5mediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowClaude Opus 5nonevsQwen3.8 Flash NextxhighQwen3.8 Flash NextxhighvsMiMo-V2.5mediumQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.5-27BnonevsGLM 5mediumLongCat 2.0mediumvsQwen3.8 Flash Nextxhigh