Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Google: Gemma 4 31B

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-24

Metriek DeepSeek V4 Pro DeepSeek V4 Pro high Releasedatum: 2026-04-24 Gemma 4 31B Gemma 4 31B medium Releasedatum: 2026-04-02 Gratis beschikbaar
Score 8.2 8.3
Rang #20 #16
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 9.6 9.2
Correcte tests
Slaagpercentage per poging 74.1% 79.6%
Instabiele tests 1 2
Totaal runs 24 54
Kosten per resultaat 1.224 0.136
Totale kosten $0.160 $0.018
Invoerprijs $1.740 / 1M $0.130 / 1M
Uitvoerprijs $3.480 / 1M $0.380 / 1M
Uitvoer-tokens 671 12,734
Redeneer-tokens 39,383 27,950
Responstijd (gem.) 71.21s 24.88s
Responstijd (max) 351.99s 70.97s
Responstijd (totaal) 1281.73s 398.13s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 8.3 10.0 75.0% 0 26.93s 70 2,008
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 93.00s 82 2,808
Gemma 4 31B 4.7 1.6 66.7% 1 70.97s 3,166 5,449
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 71.08s 134 2,163
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 63.00s 67 1,071
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.3 10.0 33.3% 0 202.56s 11 25,343
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.0 10.0 0.0% 0 26.96s 51 734
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 14.60s 21 1,236
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.6 7.4 77.8% 1 69.69s 151 3,847
Gemma 4 31B 8.8 7.9 88.9% 1 27.63s 1,797 5,596
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 11.05s 84 173
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0

Snelle vergelijking

Vergelijkingspaar wisselen