Navigatie
Advertise here

GPT 5.3 Chat vs Grok Build 0.1 (medium)

De gemiddelde score is vrijwel gelijk met 6.7 vs 6.7. GPT 5.3 Chat heeft lagere benchmarkkosten met $0.533 vs $1.419. GPT 5.3 Chat is sneller met 6.31s vs 55.13s, met slagingspercentages van 62.3% vs 58.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-03

Vergeleken modellen

Rang
#184
Totaal aantal uitvoer-tokens
28,179
Responstijd (gem.)
6.31s
Totale kosten
$0.533
Rang
#178
Totaal aantal uitvoer-tokens
529,806
Responstijd (gem.)
55.13s
Totale kosten
$1.419
Aanbevolen model GPT 5.3 Chat

Het heeft hier de beste score (6.7) en kost ongeveer 2.7x minder dan Grok Build 0.1 (medium).

Gedetailleerde vergelijking

Metriek GPT 5.3 Chat GPT 5.3 Chat none Releasedatum: 2026-03-03 Grok Build 0.1 Grok Build 0.1 medium Releasedatum: 2026-05-21
Score 6.7 6.7
Rang #184 #178
Betrouwbaarheid 10.0 10.0
Consistentie 8.6 9.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 62.3% 58.0%
Instabiele tests 4 1
Totaal runs 69 69
Kosten per resultaat 4.097 10.910
Totale kosten $0.533 $1.419
Invoerprijs $1.750 / 1M $1.000 / 1M
Uitvoerprijs $14.000 / 1M $2.000 / 1M
Prijs voor cachelezen n.v.t. $0.200 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 78,846 358,616
Uitvoer-tokens 28,179 9,651
Redeneer-tokens 0 520,155
Responstijd (gem.) 6.31s 55.13s
Responstijd (max) 18.33s 252.69s
Responstijd (totaal) 138.73s 1268.10s
Parameters ~400B totaal (~17B actief) ~300B totaal (~30B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#184 GPT 5.3 Chat

none
Kosten
$0.008
Tijd
8.1s
Tokens
634 tok

#178 SpaceXAI: Grok Build 0.1

medium
Kosten
$0.028
Tijd
81.3s
Tokens
14,009 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

Snelle vergelijking

Vergelijkingspaar wisselen