Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Verglichene Modelle

Benchmark-Vergleich Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B: Qwen3.8 27B (high) führt bei Punktzahl mit 8.7. Qwen3.8 27B (low) führt bei Zuverlässigkeit mit 10.0. Qwen3.8 27B hat den niedrigsten Gesamtkosten mit ~$0.010. Qwen3.8 27B ist mit 5.05s am schnellsten.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#55
Gesamte Ausgabe-Token
677,080
Antwortzeit (Durchschnitt)
166.34s
Gesamtkosten
~$0.298
Rang
#141
Gesamte Ausgabe-Token
170,696
Antwortzeit (Durchschnitt)
40.09s
Gesamtkosten
~$0.073
Rang
#117
Gesamte Ausgabe-Token
209,143
Antwortzeit (Durchschnitt)
46.60s
Gesamtkosten
~$0.089
Rang
#272
Gesamte Ausgabe-Token
13,791
Antwortzeit (Durchschnitt)
5.05s
Gesamtkosten
~$0.010
Empfohlenes Modell Qwen3.8 27B (high)

Es hat die stärkste Punktzahl in diesem Vergleich (8.7) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 4 Modelle.

Detaillierter Vergleich

Metrik Qwen3.8 27B Qwen3.8 27B high Veröffentlichung: 2026-08-14 Kostenlos verfügbar Qwen3.8 27B Qwen3.8 27B medium Veröffentlichung: 2026-08-14 Kostenlos verfügbar Qwen3.8 27B Qwen3.8 27B low Veröffentlichung: 2026-08-14 Kostenlos verfügbar Qwen3.8 27B Qwen3.8 27B none Veröffentlichung: 2026-08-14 Kostenlos verfügbar
Punktzahl 8.7 7.2 7.6 5.4
Rang #55 #141 #117 #272
Zuverlässigkeit 9.7 9.7 10.0 10.0
Konsistenz 9.2 9.4 9.7 10.0
Versuche 69/69 69/69 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 78.3% 66.7% 68.1% 39.1%
Instabile Tests 2 2 1 0
Gesamtläufe 69 69 69 69
Kosten pro Ergebnis ~1.751 ~0.520 ~0.589 ~0.107
Gesamtkosten ~$0.298 ~$0.073 ~$0.089 ~$0.010
Eingabepreis k. A. k. A. k. A. k. A.
Ausgabepreis k. A. k. A. k. A. k. A.
Gesamte Eingabe-Token 348,967 277,164 315,290 281,460
Ausgabe-Token 1,005 1,913 1,607 13,791
Denk-Token 676,075 168,783 207,536 0
Antwortzeit (Durchschnitt) 166.34s 40.09s 46.60s 5.05s
Antwortzeit (Maximum) 640.85s 214.63s 376.04s 47.42s
Antwortzeit (Gesamt) 3825.81s 881.89s 1071.83s 116.11s
Parameter 27.3B 27.3B 27.3B 27.3B
Verfügbarkeit Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Qwen3.8 27B

high
Kosten
~$0.008
Zeit
270.1s
Token
18,963 tok

#141 Qwen3.8 27B

medium
Kosten
~$0.002
Zeit
43.4s
Token
2,956 tok

#117 Qwen3.8 27B

low
Kosten
~$0.003
Zeit
92.8s
Token
6,902 tok

#272 Qwen3.8 27B

none
Kosten
~$0.001
Zeit
23.9s
Token
1,922 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Schnellvergleich

Vergleichspaar wechseln

Gemini 3.8 FlashlowvsQwen3.8 27BmediumKostenlos verfügbarGPT-5.2mediumvsQwen3.8 27BhighKostenlos verfügbarQwen3.8 27BhighKostenlos verfügbarvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighKostenlos verfügbarClaude Opus 4.8lowvsQwen3.8 27BmediumKostenlos verfügbarGPT-6 SollowvsQwen3.8 27BhighKostenlos verfügbarQwen3.8 27BlowKostenlos verfügbarvsSpace Bunny AlphahighQwen3.8 27BlowKostenlos verfügbarvsGLM 5.1mediumNorth Mini CodemediumKostenlos verfügbarvsQwen3.8 27BnoneKostenlos verfügbarQwen3.8 27BnoneKostenlos verfügbarvsHy4 previewlowQwen3.8 27BmediumKostenlos verfügbarvsStep 3.7 FlashlowDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighKostenlos verfügbar