Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Google: Gemini 3.5 Flash

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-19

Metriek DeepSeek V4 Pro DeepSeek V4 Pro high Releasedatum: 2026-04-24 Gemini 3.5 Flash Gemini 3.5 Flash medium Releasedatum: 2026-05-19
Score 6.9 9.2
Rang #72 #5
Betrouwbaarheid 9.3 10.0
Consistentie 8.2 10.0
Correcte tests
Slaagpercentage per poging 70.2% 89.5%
Instabiele tests 4 0
Totaal runs 57 57
Kosten per resultaat 1.927 2.307
Totale kosten $0.212 $0.393
Invoerprijs $0.435 / 1M $1.500 / 1M
Uitvoerprijs $0.870 / 1M $9.000 / 1M
Uitvoer-tokens 12,211 1,971
Redeneer-tokens 53,774 36,659
Responstijd (gem.) 58.93s 3.90s
Responstijd (max) 358.35s 12.05s
Responstijd (totaal) 1119.75s 74.13s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.4 10.0 75.0% 0 16.53s 71 3,617
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.09s 171 3,385
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 2.6 0.0 50.0% 1 51.77s 105 2,641
Gemini 3.5 Flash 10.0 10.0 100.0% 0 8.22s 431 5,190
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 465 5,914
Gemini 3.5 Flash 10.0 10.0 100.0% 0 12.05s 351 7,807
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 8.8 10.0 100.0% 0 23.62s 229 1,710
Gemini 3.5 Flash 10.0 10.0 100.0% 0 4.07s 279 3,784
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.0 6.9 16.7% 1 205.66s 10,529 28,089
Gemini 3.5 Flash 7.7 10.0 66.7% 0 5.24s 12 8,047
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 76 1,152
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 115 1,144
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 205 2,416
Gemini 3.5 Flash 9.9 10.0 100.0% 0 2.70s 71 2,855
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.4 7.2 88.9% 1 34.92s 106 3,835
Gemini 3.5 Flash 7.7 10.0 66.7% 0 2.38s 295 2,747
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 372 593
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.81s 234 455
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.0 10.0 0.0% 0 39.14s 53 3,807
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.75s 12 1,245

Snelle vergelijking

Vergelijkingspaar wisselen