Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.5

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-24

Metriek Gemini 2.5 Flash Gemini 2.5 Flash medium Releasedatum: 2025-06-17 GPT-5.5 GPT-5.5 medium Releasedatum: 2026-04-24
Score 8.2 9.0
Rang #17 #5
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 9.5 9.2
Correcte tests
Slaagpercentage per poging 75.9% 87.0%
Instabiele tests 1 2
Totaal runs 54 54
Kosten per resultaat 2.454 19.226
Totale kosten $0.319 $2.884
Invoerprijs $0.300 / 1M $5.000 / 1M
Uitvoerprijs $2.500 / 1M $30.000 / 1M
Uitvoer-tokens 1,898 1,920
Redeneer-tokens 122,273 89,632
Responstijd (gem.) 12.12s 32.75s
Responstijd (max) 95.48s 332.10s
Responstijd (totaal) 218.12s 589.59s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 16.23s 522 10,350
GPT-5.5 10.0 10.0 100.0% 0 9.09s 318 1,391
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
GPT-5.5 8.6 7.9 77.8% 1 6.78s 250 2,254
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832

Snelle vergelijking

Vergelijkingspaar wisselen