Navigatie
Advertise here

Gemini 3.7 Flash (low) vs GPT-5.3-Codex (medium)

Gemini 3.7 Flash (low) leidt in gemiddelde score met 9.4 vs 9.1. Gemini 3.7 Flash (low) heeft lagere benchmarkkosten met $0.183 vs $1.318. Gemini 3.7 Flash (low) is sneller met 6.24s vs 18.87s, met slagingspercentages van 95.7% vs 84.1%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-07

Vergeleken modellen

Rang
#25
Totaal aantal uitvoer-tokens
38,453
Responstijd (gem.)
6.24s
Totale kosten
$0.183
Rang
#34
Totaal aantal uitvoer-tokens
66,287
Responstijd (gem.)
18.87s
Totale kosten
$1.318
Aanbevolen model Gemini 3.7 Flash (low)

Het heeft hier de beste score (9.4) en kost ongeveer 7.2x minder dan GPT-5.3-Codex (medium).

Gedetailleerde vergelijking

Metriek Gemini 3.7 Flash Gemini 3.7 Flash low Releasedatum: 2026-08-14 GPT-5.3-Codex GPT-5.3-Codex medium Releasedatum: 2026-02-05
Score 9.4 9.1
Rang #25 #34
Betrouwbaarheid 10.0 10.0
Consistentie 9.3 8.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 95.7% 84.1%
Instabiele tests 2 4
Totaal runs 69 69
Kosten per resultaat 0.868 7.753
Totale kosten $0.183 $1.318
Invoerprijs $0.750 / 1M $1.750 / 1M
Uitvoerprijs $3.750 / 1M $14.000 / 1M
Prijs voor cachelezen $0.075 / 1M $0.175 / 1M
Prijs voor cacheschrijven $0.042 / 1M n.v.t.
Totaal aantal invoer-tokens 188,519 222,794
Uitvoer-tokens 7,694 7,357
Redeneer-tokens 30,759 58,930
Responstijd (gem.) 6.24s 18.87s
Responstijd (max) 58.75s 100.93s
Responstijd (totaal) 143.56s 433.94s
Parameters ~500B totaal (~20B actief) ~1.2T totaal (~80B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Gemini 3.7 Flash

low
Kosten
$0.010
Tijd
23.5s
Tokens
5,210 tok

#34 GPT-5.3-Codex

medium
Kosten
$0.049
Tijd
54.9s
Tokens
3,580 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.7 Flash 7.6 7.2 77.8% 1 6.20s 8,118 461 11,508
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

Vergelijkingspaar wisselen