Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Verglichene Modelle

Benchmark-Vergleich Qwen3.8 27B (low) vs Qwen3.8 Flash Next (low) vs Qwen3.8 27B (high) vs Qwen3.8 Flash Next (xhigh): Qwen3.8 27B (high) führt bei Punktzahl mit 8.7. Qwen3.8 27B (low) führt bei Zuverlässigkeit mit 10.0. Qwen3.8 Flash Next (low) hat den niedrigsten Gesamtkosten mit ~$0.045. Qwen3.8 Flash Next (low) ist mit 23.66s am schnellsten.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-05

Verglichene Modelle

Rang
#121
Gesamte Ausgabe-Token
209,143
Antwortzeit (Durchschnitt)
46.60s
Gesamtkosten
~$0.089
Rang
#96
Gesamte Ausgabe-Token
135,295
Antwortzeit (Durchschnitt)
23.66s
Gesamtkosten
~$0.045
Rang
#55
Gesamte Ausgabe-Token
677,080
Antwortzeit (Durchschnitt)
166.34s
Gesamtkosten
~$0.298
Rang
#154
Gesamte Ausgabe-Token
621,056
Antwortzeit (Durchschnitt)
102.66s
Gesamtkosten
~$0.195
Empfohlenes Modell Qwen3.8 Flash Next (low)

Die Punktzahl bleibt nah an der besten hier (8.0 vs 8.7) und es kostet etwa 4.3x weniger als die anderen Modelle in diesem Vergleich.

Detaillierter Vergleich

Metrik Qwen3.8 27B Qwen3.8 27B low Veröffentlichung: 2026-08-14 Kostenlos verfügbar Qwen3.8 Flash Next Qwen3.8 Flash Next low Veröffentlichung: 2026-10-04 Qwen3.8 27B Qwen3.8 27B high Veröffentlichung: 2026-08-14 Kostenlos verfügbar Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Veröffentlichung: 2026-10-04
Punktzahl 7.6 8.0 8.7 7.1
Rang #121 #96 #55 #154
Zuverlässigkeit 10.0 10.0 9.7 9.9
Konsistenz 9.7 8.0 9.2 7.9
Versuche 69/69 69/69 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 68.1% 79.7% 78.3% 72.5%
Instabile Tests 1 6 2 6
Gesamtläufe 69 69 69 69
Kosten pro Ergebnis ~0.589 ~0.299 ~1.751 ~1.390
Gesamtkosten ~$0.089 ~$0.045 ~$0.298 ~$0.195
Eingabepreis k. A. k. A. k. A. k. A.
Ausgabepreis k. A. k. A. k. A. k. A.
Preis für Cache-Lesen k. A. k. A. k. A. k. A.
Preis für Cache-Schreiben k. A. k. A. k. A. k. A.
Gesamte Eingabe-Token 315,290 342,163 348,967 301,749
Ausgabe-Token 1,607 1,518 1,005 1,033
Denk-Token 207,536 133,777 676,075 620,023
Antwortzeit (Durchschnitt) 46.60s 23.66s 166.34s 102.66s
Antwortzeit (Maximum) 376.04s 166.72s 640.85s 674.08s
Antwortzeit (Gesamt) 1071.83s 544.16s 3825.81s 2361.10s
Parameter 27.3B 180B insgesamt (6B aktiv) 27.3B 180B insgesamt (6B aktiv)
Verfügbarkeit Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#121 Qwen3.8 27B

low
Kosten
~$0.003
Zeit
92.8s
Token
6,902 tok

#96 Qwen3.8 Flash Next

low
Kosten
~$0.002
Zeit
47.2s
Token
5,270 tok

#55 Qwen3.8 27B

high
Kosten
~$0.008
Zeit
270.1s
Token
18,963 tok

#154 Qwen3.8 Flash Next

xhigh
Kosten
~$0.010
Zeit
333.1s
Token
30,654 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070

Schnellvergleich

Vergleichspaar wechseln

GPT-5.2mediumvsQwen3.8 27BhighKostenlos verfügbarQwen3.8 27BhighKostenlos verfügbarvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighKostenlos verfügbarGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowGPT-6 SollowvsQwen3.8 27BhighKostenlos verfügbarQwen3.8 27BlowKostenlos verfügbarvsSpace Bunny AlphahighQwen3.8 27BlowKostenlos verfügbarvsGLM 5.1mediumQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumKostenlos verfügbarvsQwen3.8 Flash Nextlow