Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs xAI: Grok 4.20

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-24

Metriek DeepSeek V4 Pro DeepSeek V4 Pro high Releasedatum: 2026-04-24 Grok 4.20 Grok 4.20 medium Releasedatum: 2026-03-31
Score 7.4 7.0
Rang #50 #54
Consistentie 10.0 7.8
Correcte tests
Slaagpercentage per poging 61.1% 66.7%
Instabiele tests 0 5
Totaal runs 24 54
Kosten per resultaat 1.385 8.252
Totale kosten $0.153 $0.743
Invoerprijs $1.740 / 1M $2.000 / 1M
Uitvoerprijs $3.480 / 1M $6.000 / 1M
Uitvoer-tokens 584 1,744
Redeneer-tokens 37,708 109,882
Responstijd (gem.) 78.45s 10.33s
Responstijd (max) 351.99s 29.87s
Responstijd (totaal) 1255.22s 185.87s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 8.3 10.0 75.0% 0 32.12s 64 1,799
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 93.00s 82 2,808
Grok 4.20 4.3 1.1 66.7% 1 24.33s 250 12,804
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 71.08s 134 2,163
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 63.00s 67 1,071
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.3 10.0 33.3% 0 202.56s 11 25,343
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.0 10.0 0.0% 0 26.96s 51 734
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.0 10.0 0.0% 0 0ms 0 0
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.7 10.0 66.7% 0 63.66s 91 3,617
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 11.05s 84 173
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620

Snelle vergelijking

Vergelijkingspaar wisselen