Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Fable 5.1 (medium) vs GPT-6 Luna (high)

De gemiddelde score is vrijwel gelijk met 8.3 vs 8.3. GPT-6 Luna (high) heeft lagere benchmarkkosten met $0.054 vs $2.909. Claude Fable 5.1 (medium) is sneller met 11.67s vs 17.53s, met slagingspercentages van 81.8% vs 75.8%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-23

Vergeleken modellen

Rang
#74
Totaal aantal uitvoer-tokens
31,152
Responstijd (gem.)
11.67s
Totale kosten
$2.909
Rang
#73
Totaal aantal uitvoer-tokens
91,405
Responstijd (gem.)
17.53s
Totale kosten
$0.054
Aanbevolen model GPT-6 Luna (high)

Het heeft hier de beste score (8.3) en kost ongeveer 54.1x minder dan Claude Fable 5.1 (medium).

Gedetailleerde vergelijking

Metriek Claude Fable 5.1 Claude Fable 5.1 medium Releasedatum: 2026-09-02 GPT-6 Luna GPT-6 Luna high Releasedatum: 2026-09-23
Score 8.3 8.3
Rang #74 #73
Betrouwbaarheid 10.0 10.0
Consistentie 7.8 9.0
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 81.8% 75.8%
Instabiele tests 6 3
Totaal runs 66 66
Kosten per resultaat 19.392 0.359
Totale kosten $2.909 $0.054
Invoerprijs $10.000 / 1M $0.100 / 1M
Uitvoerprijs $50.000 / 1M $0.500 / 1M
Totaal aantal invoer-tokens 135,112 80,441
Uitvoer-tokens 7,594 4,761
Redeneer-tokens 23,558 86,644
Responstijd (gem.) 11.67s 17.53s
Responstijd (max) 36.59s 106.93s
Responstijd (totaal) 256.73s 385.74s
Parameters ~9.5T totaal (~878B actief) ~400B totaal (~17B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Fable 5.1

medium
Kosten
$0.244
Tijd
65.9s
Tokens
5,025 tok

#73 GPT-6 Luna

high
Kosten
$0.003
Tijd
49.2s
Tokens
5,231 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Fable 5.1 7.0 5.0 77.8% 2 10.99s 10,608 525 4,376
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

Snelle vergelijking

Vergelijkingspaar wisselen