Navigation
Advertise here

Qwen3.8 Flash Next (xhigh) vs GLM 5.3 FlashX (medium)

Der Durchschnittsscore ist mit 7.1 vs 7.1 praktisch gleichauf. GLM 5.3 FlashX (medium) hat die niedrigeren Benchmark-Kosten mit $0.114 vs ~$0.195. GLM 5.3 FlashX (medium) ist schneller mit 7.37s vs 102.66s, mit Erfolgsraten von 72.5% vs 69.6%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#154
Gesamte Ausgabe-Token
621,056
Antwortzeit (Durchschnitt)
102.66s
Gesamtkosten
~$0.195
Rang
#155
Gesamte Ausgabe-Token
30,048
Antwortzeit (Durchschnitt)
7.37s
Gesamtkosten
$0.114
Empfohlenes Modell GLM 5.3 FlashX (medium)

Es hat hier die beste Punktzahl (7.1) und kostet etwa 1.7x weniger als Qwen3.8 Flash Next (xhigh).

Detaillierter Vergleich

Metrik Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Veröffentlichung: 2026-10-04 GLM 5.3 FlashX GLM 5.3 FlashX medium Veröffentlichung: 2026-09-21
Punktzahl 7.1 7.1
Rang #154 #155
Zuverlässigkeit 9.9 10.0
Konsistenz 7.9 7.1
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 72.5% 69.6%
Instabile Tests 6 8
Gesamtläufe 69 69
Kosten pro Ergebnis ~1.390 0.946
Gesamtkosten ~$0.195 $0.114
Eingabepreis k. A. $0.370 / 1M
Ausgabepreis k. A. $1.250 / 1M
Preis für Cache-Lesen k. A. $0.090 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 301,749 205,100
Ausgabe-Token 1,033 8,639
Denk-Token 620,023 21,409
Antwortzeit (Durchschnitt) 102.66s 7.37s
Antwortzeit (Maximum) 674.08s 74.39s
Antwortzeit (Gesamt) 2361.10s 169.54s
Parameter 180B insgesamt (6B aktiv) 320B insgesamt (18B aktiv)
Verfügbarkeit Gewichte verfügbar Geschlossen

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.8 Flash Next

xhigh
Kosten
~$0.010
Zeit
333.1s
Token
30,654 tok

#155 GLM 5.3 FlashX

medium
Kosten
$0.002
Zeit
8.1s
Token
1,480 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070
GLM 5.3 FlashX 6.0 4.6 66.7% 2 6.37s 7,317 384 5,562

Schnellvergleich

Vergleichspaar wechseln

MiMo-V2.6-FlashlowvsGLM 5.3 FlashXmediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowClaude Opus 5nonevsQwen3.8 Flash NextxhighQwen3.8 Flash NextxhighvsMiMo-V2.5mediumGPT-5.2 ChatnonevsGLM 5.3 FlashXmediumQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.8 Flash NextxhighvsGLM 5mediumLongCat 2.0mediumvsQwen3.8 Flash NextxhighClaude Opus 5nonevsGLM 5.3 FlashXmediumGPT-5.2 ChatnonevsQwen3.8 Flash NextxhighEmber-1lowvsGLM 5.3 FlashXmediumStep 3.7 FlashlowvsGLM 5.3 FlashXmedium