Navigation
Advertise here

Qwen3.8 Flash Next (xhigh) vs MiMo-V2.6-Flash (low)

Der Durchschnittsscore ist mit 7.1 vs 7.1 praktisch gleichauf. Qwen3.8 Flash Next (xhigh) hat die niedrigeren Benchmark-Kosten mit ~$0.195 vs $0.200. MiMo-V2.6-Flash (low) ist schneller mit 54.57s vs 102.66s, mit Erfolgsraten von 72.5% vs 66.7%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#154
Gesamte Ausgabe-Token
621,056
Antwortzeit (Durchschnitt)
102.66s
Gesamtkosten
~$0.195
Rang
#156
Gesamte Ausgabe-Token
585,416
Antwortzeit (Durchschnitt)
54.57s
Gesamtkosten
$0.200
Empfohlenes Modell MiMo-V2.6-Flash (low)

Es hat hier die beste Punktzahl (7.1) und antwortet etwa 1.9x schneller als Qwen3.8 Flash Next (xhigh).

Detaillierter Vergleich

Metrik Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Veröffentlichung: 2026-10-04 MiMo-V2.6-Flash MiMo-V2.6-Flash low Veröffentlichung: 2026-09-22
Punktzahl 7.1 7.1
Rang #154 #156
Zuverlässigkeit 9.9 10.0
Konsistenz 7.9 7.9
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 72.5% 66.7%
Instabile Tests 6 6
Gesamtläufe 69 69
Kosten pro Ergebnis ~1.390 1.666
Gesamtkosten ~$0.195 $0.200
Eingabepreis k. A. $0.140 / 1M
Ausgabepreis k. A. $0.280 / 1M
Preis für Cache-Lesen k. A. $0.003 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 301,749 256,428
Ausgabe-Token 1,033 9,786
Denk-Token 620,023 575,630
Antwortzeit (Durchschnitt) 102.66s 54.57s
Antwortzeit (Maximum) 674.08s 345.18s
Antwortzeit (Gesamt) 2361.10s 1255.15s
Parameter 180B insgesamt (6B aktiv) 309B insgesamt (15B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.8 Flash Next

xhigh
Kosten
~$0.010
Zeit
333.1s
Token
30,654 tok

#156 MiMo-V2.6-Flash

low
Kosten
$0.009
Zeit
167.2s
Token
29,794 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070
MiMo-V2.6-Flash 8.4 7.4 88.9% 1 10.97s 7,422 405 21,894

Schnellvergleich

Vergleichspaar wechseln

MiMo-V2.6-FlashlowvsGLM 5.3 FlashXmediumQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumClaude Opus 5nonevsQwen3.8 Flash NextxhighGPT-5.2 ChatnonevsMiMo-V2.6-FlashlowQwen3.8 Flash NextxhighvsMiMo-V2.5mediumGemini 3.1 Flash Lite PreviewmediumvsMiMo-V2.6-FlashlowQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.8 Flash NextxhighvsGLM 5mediumKimi K2.7 CodemediumvsMiMo-V2.6-FlashlowLongCat 2.0mediumvsQwen3.8 Flash NextxhighClaude Opus 5nonevsMiMo-V2.6-FlashlowGPT-5.2 ChatnonevsQwen3.8 Flash Nextxhigh