Navigatie
AI BENCHY
Advertise here

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5.2 Chat

Gemini 3.1 Pro Preview (medium) leidt in gemiddelde score met 9.2 vs 8.0. GPT-5.2 Chat heeft lagere benchmarkkosten met $0.604 vs $1.361. GPT-5.2 Chat is sneller met 7.65s vs 21.47s, met slagingspercentages van 90.9% vs 74.2%.

Aanbevolen modelGemini 3.1 Pro Preview (medium)Het heeft de sterkste score in deze vergelijking (9.2) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-07-25

Metriek Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Releasedatum: 2026-02-19 GPT-5.2 Chat GPT-5.2 Chat none Releasedatum: 2025-12-11
Score 9.2 8.0
Rang #10 #37
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 8.6
Correcte tests
Slaagpercentage per poging 90.9% 74.2%
Instabiele tests 0 4
Totaal runs 66 66
Kosten per resultaat 6.801 4.308
Totale kosten $1.361 $0.604
Invoerprijs $2.000 / 1M $1.750 / 1M
Uitvoerprijs $12.000 / 1M $14.000 / 1M
Totaal aantal invoer-tokens 92,287 101,248
Uitvoer-tokens 5,232 30,424
Redeneer-tokens 92,726 0
Responstijd (gem.) 21.47s 7.65s
Responstijd (max) 88.68s 38.52s
Responstijd (totaal) 322.08s 168.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 Gemini 3.1 Pro Preview

medium
Kosten
$0.115
Tijd
87.2s
Tokens
9,629 tok

#37 GPT-5.2 Chat

none
Kosten
$0.010
Tijd
15.3s
Tokens
797 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

Snelle vergelijking

Vergelijkingspaar wisselen