Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (medium) vs Qwen3.5-27B

Claude Fable 5.1 (medium) führt beim Durchschnittsscore mit 7.3 vs 7.2. Qwen3.5-27B hat die niedrigeren Benchmark-Kosten mit $0.116 vs $3.197. Qwen3.5-27B ist schneller mit 9.98s vs 11.87s, mit Erfolgsraten von 78.3% vs 47.8%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#133
Gesamte Ausgabe-Token
32,506
Antwortzeit (Durchschnitt)
11.87s
Gesamtkosten
$3.197
Rang
#139
Gesamte Ausgabe-Token
36,422
Antwortzeit (Durchschnitt)
9.98s
Gesamtkosten
$0.116
Empfohlenes Modell Qwen3.5-27B

Die Punktzahl bleibt nah an der besten hier (7.2 vs 7.3) und es kostet etwa 27.7x weniger als Claude Fable 5.1 (medium).

Detaillierter Vergleich

Metrik Claude Fable 5.1 Claude Fable 5.1 medium Veröffentlichung: 2026-09-02 Qwen3.5-27B Qwen3.5-27B none Veröffentlichung: 2026-02-24
Punktzahl 7.3 7.2
Rang #133 #139
Zuverlässigkeit 10.0 10.0
Konsistenz 7.9 9.4
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 78.3% 47.8%
Instabile Tests 6 2
Gesamtläufe 69 69
Kosten pro Ergebnis 21.312 1.153
Gesamtkosten $3.197 $0.116
Eingabepreis $10.000 / 1M $0.195 / 1M
Ausgabepreis $50.000 / 1M $1.560 / 1M
Gesamte Eingabe-Token 157,142 283,977
Ausgabe-Token 8,149 36,422
Denk-Token 24,357 0
Antwortzeit (Durchschnitt) 11.87s 9.98s
Antwortzeit (Maximum) 36.59s 124.53s
Antwortzeit (Gesamt) 272.91s 229.52s
Parameter ~9.5T insgesamt (~878B aktiv) 27B
Verfügbarkeit Geschlossen Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Claude Fable 5.1

medium
Kosten
$0.244
Zeit
65.9s
Token
5,025 tok

#139 Qwen3.5-27B

none
Kosten
$0.007
Zeit
42.9s
Token
4,273 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

Schnellvergleich

Vergleichspaar wechseln