Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs Mistral: Mistral Small 4

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-01

Metriek Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Releasedatum: 2026-02-19 Mistral Small 4 Mistral Small 4 medium Releasedatum: 2026-03-16
Score 9.6 5.7
Rang #2 #99
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 10.0 6.8
Correcte tests
Slaagpercentage per poging 94.4% 50.0%
Instabiele tests 0 7
Totaal runs 54 54
Kosten per resultaat 3.400 0.674
Totale kosten $0.578 $0.034
Invoerprijs $2.000 / 1M $0.150 / 1M
Uitvoerprijs $12.000 / 1M $0.600 / 1M
Uitvoer-tokens 1,932 15,084
Redeneer-tokens 40,542 39,408
Responstijd (gem.) 15.96s 5.64s
Responstijd (max) 40.61s 30.49s
Responstijd (totaal) 175.52s 101.52s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.90s 112 3,218
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 19.88s 405 4,201
Mistral Small 4 6.7 3.5 66.7% 1 30.49s 2,796 11,296
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 9.5 10.0 100.0% 0 40.61s 432 9,281
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.72s 279 3,904
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 7.7 10.0 66.7% 0 32.73s 18 12,424
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810

Snelle vergelijking

Vergelijkingspaar wisselen