Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs xAI: Grok 4.20 Beta

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-12

Metriek Gemini 3 Flash Preview Gemini 3 Flash Preview low Releasedatum: 2025-12-17 Grok 4.20 Beta Grok 4.20 Beta medium Releasedatum: 2026-03-12
Rang #6 #24
Gem. score 8.2 7.0
Consistentie 9.5 9.0
Kosten per resultaat 0.607 5.989
Totale kosten $0.079 $0.599
Correcte tests
Slaagpercentage per poging 83.3% 70.8%
Instabiele tests 1 2
Totaal runs 48 48
Uitvoer-tokens 1,586 1,481
Redeneer-tokens 19,950 86,628
Responstijd (gem.) 6.11s 8.89s
Responstijd (max) 14.72s 24.21s
Responstijd (totaal) 97.74s 142.18s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Gem. score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Gem. score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.50s 275 2,476
Grok 4.20 Beta 7.0 7.2 88.9% 1 3.19s 262 6,289
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 10.0 10.0 0.0% 0 3.27s 326 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 9.9 10.0 100.0% 0 9.40s 279 3,656
Grok 4.20 Beta 9.9 10.0 100.0% 0 4.01s 180 5,281
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 4.0 7.2 44.4% 1 8.05s 12 6,410
Grok 4.20 Beta 4.0 10.0 33.3% 0 21.33s 251 40,255
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.68s 120 981
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 9.5 10.0 100.0% 0 7.02s 71 2,752
Grok 4.20 Beta 9.0 10.0 50.0% 0 4.97s 57 7,107
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 6.11s 269 3,260
Grok 4.20 Beta 7.0 7.2 88.9% 1 3.85s 249 6,660
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.99s 234 415
Grok 4.20 Beta 10.0 10.0 0.0% 0 12.39s 183 5,384

Snelle vergelijking

Vergelijkingspaar wisselen