Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs OpenAI: gpt-oss-120b

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-19

Metriek Gemini 3.5 Flash Gemini 3.5 Flash low Releasedatum: 2026-05-19 gpt-oss-120b gpt-oss-120b medium Releasedatum: 2025-08-05 Gratis beschikbaar
Score 9.6 5.7
Rang #2 #106
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 7.4
Correcte tests
Slaagpercentage per poging 94.7% 49.1%
Instabiele tests 0 6
Totaal runs 57 57
Kosten per resultaat 1.359 0.152
Totale kosten $0.245 $0.011
Invoerprijs $1.500 / 1M $0.000 / 1M
Uitvoerprijs $9.000 / 1M $0.000 / 1M
Uitvoer-tokens 2,003 16,594
Redeneer-tokens 20,245 40,637
Responstijd (gem.) 2.84s 16.95s
Responstijd (max) 6.44s 50.92s
Responstijd (totaal) 54.00s 203.39s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 209 2,536
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 3,518 2,177
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 5.49s 428 3,146
gpt-oss-120b 4.3 1.1 66.7% 1 26.33s 228 2,549
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 351 3,050
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 279 1,164
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 241 1,114
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 12 4,538
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 6,784 20,606
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 119 916
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 107 387
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 71 1,652
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 126 1,799
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 288 2,150
gpt-oss-120b 3.2 4.7 22.2% 2 11.80s 1,508 2,092
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 234 403
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 287 1,083
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 12 690
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 3,101 3,758

Snelle vergelijking

Vergelijkingspaar wisselen