Navigatie
AI BENCHY
Advertise here

Claude Fable 5.1 (high) vs GPT-5.3-Codex (medium)

Claude Fable 5.1 (high) leidt in gemiddelde score met 9.0 vs 8.9. GPT-5.3-Codex (medium) heeft lagere benchmarkkosten met $0.988 vs $3.364. Claude Fable 5.1 (high) is sneller met 13.59s vs 16.91s, met slagingspercentages van 89.4% vs 83.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-02

Rang
#18
Totaal aantal uitvoer-tokens
40,071
Responstijd (gem.)
13.59s
Totale kosten
$3.364
Rang
#23
Totaal aantal uitvoer-tokens
60,374
Responstijd (gem.)
16.91s
Totale kosten
$0.988
Aanbevolen model GPT-5.3-Codex (medium)

De score blijft dicht bij de beste score hier (8.9 vs 9.0) en het kost ongeveer 3.4x minder dan Claude Fable 5.1 (high).

Gedetailleerde vergelijking

Metriek Claude Fable 5.1 Claude Fable 5.1 high Releasedatum: 2026-09-02 GPT-5.3-Codex GPT-5.3-Codex medium Releasedatum: 2026-02-05
Score 9.0 8.9
Rang #18 #23
Betrouwbaarheid 10.0 10.0
Consistentie 9.6 8.6
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 89.4% 83.3%
Instabiele tests 1 4
Totaal runs 66 66
Kosten per resultaat 17.701 6.171
Totale kosten $3.364 $0.988
Invoerprijs $10.000 / 1M $1.750 / 1M
Uitvoerprijs $50.000 / 1M $14.000 / 1M
Totaal aantal invoer-tokens 135,958 81,187
Uitvoer-tokens 7,930 6,258
Redeneer-tokens 32,141 54,116
Responstijd (gem.) 13.59s 16.91s
Responstijd (max) 40.17s 100.93s
Responstijd (totaal) 298.90s 372.03s
Parameters ~9.5T totaal (~878B actief) ~1.2T totaal (~80B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#18 Claude Fable 5.1

high
Kosten
$0.384
Tijd
102.5s
Tokens
7,824 tok

#23 GPT-5.3-Codex

medium
Kosten
$0.049
Tijd
54.9s
Tokens
3,580 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Snelle vergelijking

Vergelijkingspaar wisselen