Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Verglichene Modelle

Benchmark-Vergleich Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B: Qwen3.8 27B (high) führt bei Punktzahl mit 8.4. Qwen3.8 27B (low) führt bei Zuverlässigkeit mit 10.0. Qwen3.8 27B hat den niedrigsten Gesamtkosten mit ~$0.006. Qwen3.8 27B ist mit 3.12s am schnellsten.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-15

Rang
#42
Gesamte Ausgabe-Token
656,635
Antwortzeit (Durchschnitt)
167.89s
Gesamtkosten
~$0.287
Rang
#68
Gesamte Ausgabe-Token
136,162
Antwortzeit (Durchschnitt)
33.05s
Gesamtkosten
~$0.058
Rang
#61
Gesamte Ausgabe-Token
169,329
Antwortzeit (Durchschnitt)
39.11s
Gesamtkosten
~$0.071
Rang
#214
Gesamte Ausgabe-Token
11,445
Antwortzeit (Durchschnitt)
3.12s
Gesamtkosten
~$0.006
Empfohlenes Modell Qwen3.8 27B

Es bietet den besten Gesamtkompromiss: wettbewerbsfähige Punktzahl (5.5), niedrigere Kosten als die anderen Modelle in diesem Vergleich und ausgewogene Antwortzeit.

Detaillierter Vergleich

Metrik Qwen3.8 27B Qwen3.8 27B high Veröffentlichung: 2026-08-14 Qwen3.8 27B Qwen3.8 27B medium Veröffentlichung: 2026-08-14 Qwen3.8 27B Qwen3.8 27B low Veröffentlichung: 2026-08-14 Qwen3.8 27B Qwen3.8 27B none Veröffentlichung: 2026-08-14
Punktzahl 8.4 7.8 7.9 5.5
Rang #42 #68 #61 #214
Zuverlässigkeit 9.6 9.6 10.0 10.0
Konsistenz 9.2 9.7 10.0 10.0
Versuche 66/66 66/66 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 77.3% 66.7% 68.2% 40.9%
Instabile Tests 2 1 0 0
Gesamtläufe 66 66 66 66
Kosten pro Ergebnis ~1.792 ~0.409 ~0.473 ~0.063
Gesamtkosten ~$0.287 ~$0.058 ~$0.071 ~$0.006
Eingabepreis k. A. k. A. k. A. k. A.
Ausgabepreis k. A. k. A. k. A. k. A.
Gesamte Eingabe-Token 100,179 98,266 99,705 122,463
Ausgabe-Token 904 1,861 1,545 11,445
Denk-Token 655,731 134,301 167,784 0
Antwortzeit (Durchschnitt) 167.89s 33.05s 39.11s 3.12s
Antwortzeit (Maximum) 640.85s 214.63s 376.04s 44.76s
Antwortzeit (Gesamt) 3693.54s 694.04s 860.51s 68.69s
Parameter 27.3B 27.3B 27.3B 27.3B
Verfügbarkeit Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar Gewichte verfügbar

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Kosten
~$0.008
Zeit
270.1s
Token
18,963 tok

#68 Qwen3.8 27B

medium
Kosten
~$0.002
Zeit
43.4s
Token
2,956 tok

#61 Qwen3.8 27B

low
Kosten
~$0.003
Zeit
92.8s
Token
6,902 tok

#214 Qwen3.8 27B

none
Kosten
~$0.001
Zeit
23.9s
Token
1,922 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Schnellvergleich

Vergleichspaar wechseln

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowClaude Opus 4.8lowvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BlowNemotron 3.5 LightninghighKostenlos verfügbarvsQwen3.8 27BnoneKAT-Coder-Air V2.5mediumvsQwen3.8 27BnoneQwen3.8 27BhighvsGrok 4.6mediumGPT-5.6 TerrahighvsQwen3.8 27BlowSeed-2.0-CodelowvsQwen3.8 27Bmedium