Navigatie
Advertise here

GPT-5.3-Codex (medium) vs GPT-5.5 (medium)

GPT-5.5 (medium) leidt in gemiddelde score met 9.2 vs 9.1. GPT-5.3-Codex (medium) heeft lagere benchmarkkosten met $1.318 vs $4.809. GPT-5.3-Codex (medium) is sneller met 18.87s vs 39.86s, met slagingspercentages van 84.1% vs 88.4%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#34
Totaal aantal uitvoer-tokens
66,287
Responstijd (gem.)
18.87s
Totale kosten
$1.318
Rang
#30
Totaal aantal uitvoer-tokens
130,107
Responstijd (gem.)
39.86s
Totale kosten
$4.809
Aanbevolen model GPT-5.3-Codex (medium)

De score blijft dicht bij de beste score hier (9.1 vs 9.2) en het kost ongeveer 3.6x minder dan GPT-5.5 (medium).

Gedetailleerde vergelijking

Metriek GPT-5.3-Codex GPT-5.3-Codex medium Releasedatum: 2026-02-05 GPT-5.5 GPT-5.5 medium Releasedatum: 2026-04-24
Score 9.1 9.2
Rang #34 #30
Betrouwbaarheid 10.0 10.0
Consistentie 8.6 9.0
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 84.1% 88.4%
Instabiele tests 4 3
Totaal runs 69 69
Kosten per resultaat 7.753 25.306
Totale kosten $1.318 $4.809
Invoerprijs $1.750 / 1M $5.000 / 1M
Uitvoerprijs $14.000 / 1M $30.000 / 1M
Prijs voor cachelezen $0.175 / 1M $0.500 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 222,794 180,959
Uitvoer-tokens 7,357 6,472
Redeneer-tokens 58,930 123,635
Responstijd (gem.) 18.87s 39.86s
Responstijd (max) 100.93s 332.10s
Responstijd (totaal) 433.94s 916.82s
Parameters ~1.2T totaal (~80B actief) ~1.5T totaal (~100B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 GPT-5.3-Codex

medium
Kosten
$0.049
Tijd
54.9s
Tokens
3,580 tok

#30 GPT-5.5

medium
Kosten
$0.112
Tijd
71.9s
Tokens
3,807 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

Vergelijkingspaar wisselen