Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: GPT-5.4

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-22

Metriek Gemini 3.5 Flash Gemini 3.5 Flash high Releasedatum: 2026-05-19 GPT-5.4 GPT-5.4 medium Releasedatum: 2026-03-05
Score 9.6 7.9
Rang #2 #27
Betrouwbaarheid 10.0 10.0
Consistentie 9.6 8.5
Correcte tests
Slaagpercentage per poging 96.7% 75.0%
Instabiele tests 1 4
Totaal runs 60 60
Kosten per resultaat 5.231 8.767
Totale kosten $0.994 $1.140
Invoerprijs $1.500 / 1M $2.500 / 1M
Uitvoerprijs $9.000 / 1M $15.000 / 1M
Uitvoer-tokens 1,969 2,222
Redeneer-tokens 102,679 68,503
Responstijd (gem.) 8.30s 22.31s
Responstijd (max) 34.82s 100.41s
Responstijd (totaal) 165.92s 446.15s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.57s 174 4,997
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 24.62s 450 34,170
GPT-5.4 8.2 6.7 83.3% 1 54.98s 412 19,995
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 22.37s 351 16,323
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.43s 279 8,466
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 7.6 7.2 77.8% 1 14.09s 12 24,721
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.63s 115 1,650
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.35s 70 3,799
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.23s 241 4,940
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 9.8 10.0 100.0% 0 4.96s 265 1,608
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.94s 12 2,005
GPT-5.4 3.0 10.0 0.0% 0 13.95s 30 1,821

Snelle vergelijking

Vergelijkingspaar wisselen