Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs OpenAI: GPT-5 Nano

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-29

Metriek Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Releasedatum: 2026-02-19 GPT-5 Nano GPT-5 Nano medium Releasedatum: 2025-08-07
Score 9.6 6.3
Rang #2 #74
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 10.0 6.5
Correcte tests
Slaagpercentage per poging 94.4% 59.3%
Instabiele tests 0 8
Totaal runs 54 54
Kosten per resultaat 3.400 0.942
Totale kosten $0.578 $0.066
Invoerprijs $2.000 / 1M $0.050 / 1M
Uitvoerprijs $12.000 / 1M $0.400 / 1M
Uitvoer-tokens 1,932 4,980
Redeneer-tokens 40,542 156,288
Responstijd (gem.) 15.96s 44.13s
Responstijd (max) 40.61s 204.02s
Responstijd (totaal) 175.52s 485.47s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
GPT-5 Nano 6.5 7.9 58.3% 1 25.50s 1,221 21,184
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 19.88s 405 4,201
GPT-5 Nano 6.7 3.5 66.7% 1 40.73s 480 12,992
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
GPT-5 Nano 10.0 10.0 100.0% 0 65.96s 578 17,984
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
GPT-5 Nano 3.7 1.7 50.0% 2 21.42s 453 10,560
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
GPT-5 Nano 5.2 4.4 55.6% 2 204.02s 237 64,448
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
GPT-5 Nano 4.1 10.0 0.0% 0 17.51s 202 4,608
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
GPT-5 Nano 8.5 6.8 83.3% 1 11.90s 382 4,096
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
GPT-5 Nano 5.3 7.2 44.4% 1 19.81s 869 13,440
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
GPT-5 Nano 10.0 10.0 100.0% 0 33.30s 558 6,976

Snelle vergelijking

Vergelijkingspaar wisselen