Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.4

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-04

Metriek Gemini 3.5 Flash Gemini 3.5 Flash medium Releasedatum: 2026-05-19 GPT-5.4 GPT-5.4 medium Releasedatum: 2026-03-05
Score 9.0 8.0
Rang #7 #21
Betrouwbaarheid 10.0 10.0
Consistentie 9.6 8.6
Correcte tests
Slaagpercentage per poging 87.3% 76.2%
Instabiele tests 1 4
Totaal runs 63 63
Kosten per resultaat 3.229 8.640
Totale kosten $0.582 $1.210
Invoerprijs $1.500 / 1M $2.500 / 1M
Uitvoerprijs $9.000 / 1M $15.000 / 1M
Totaal aantal invoer-tokens 36,936 34,108
Uitvoer-tokens 2,001 2,242
Redeneer-tokens 56,408 72,707
Responstijd (gem.) 4.94s 22.35s
Responstijd (max) 18.07s 100.41s
Responstijd (totaal) 103.79s 469.29s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.09s 492 171 3,385
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 7.9 7.5 77.8% 1 12.63s 8,118 461 24,939
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 12.05s 12,873 351 7,807
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 4.07s 7,548 279 3,784
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 7.7 10.0 66.7% 0 5.24s 633 12 8,047
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 486 115 1,144
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 9.9 10.0 100.0% 0 2.70s 615 71 2,855
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 7.7 10.0 66.7% 0 2.38s 558 295 2,747
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.81s 5,457 234 455
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.75s 156 12 1,245
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

Snelle vergelijking

Vergelijkingspaar wisselen