Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (medium) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) leidt in gemiddelde score met 8.4 vs 8.3. Qwen3.8 27B (high) heeft lagere benchmarkkosten met ~$0.287 vs $2.909. Claude Fable 5.1 (medium) is sneller met 11.67s vs 167.89s, met slagingspercentages van 81.8% vs 77.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-02

Rang
#48
Totaal aantal uitvoer-tokens
31,152
Responstijd (gem.)
11.67s
Totale kosten
$2.909
Rang
#44
Totaal aantal uitvoer-tokens
656,635
Responstijd (gem.)
167.89s
Totale kosten
~$0.287
Aanbevolen model Qwen3.8 27B (high)

Het heeft hier de beste score (8.4) en kost ongeveer 10.1x minder dan Claude Fable 5.1 (medium).

Gedetailleerde vergelijking

Metriek Claude Fable 5.1 Claude Fable 5.1 medium Releasedatum: 2026-09-02 Qwen3.8 27B Qwen3.8 27B high Releasedatum: 2026-08-14
Score 8.3 8.4
Rang #48 #44
Betrouwbaarheid 10.0 9.6
Consistentie 7.8 9.2
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 81.8% 77.3%
Instabiele tests 6 2
Totaal runs 66 66
Kosten per resultaat 19.392 ~1.792
Totale kosten $2.909 ~$0.287
Invoerprijs $10.000 / 1M n.v.t.
Uitvoerprijs $50.000 / 1M n.v.t.
Totaal aantal invoer-tokens 135,112 100,179
Uitvoer-tokens 7,594 904
Redeneer-tokens 23,558 655,731
Responstijd (gem.) 11.67s 167.89s
Responstijd (max) 36.59s 640.85s
Responstijd (totaal) 256.73s 3693.54s
Parameters ~9.5T totaal (~878B actief) 27.3B
Beschikbaarheid Gesloten broncode Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 Claude Fable 5.1

medium
Kosten
$0.244
Tijd
65.9s
Tokens
5,025 tok

#44 Qwen3.8 27B

high
Kosten
~$0.008
Tijd
270.1s
Tokens
18,963 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

Snelle vergelijking

Vergelijkingspaar wisselen

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowClaude Fable 5.1mediumvsMuse Spark 1.1lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5mediumMuse Spark 1.1lowvsQwen3.8 27BhighClaude Fable 5.1mediumvsInkling SmallhighClaude Fable 5.1mediumvsGrok 4.5lowGPT-5.4mediumvsQwen3.8 27BhighGemini 2.5 FlashmediumvsQwen3.8 27Bhigh