Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs OpenAI: GPT-5 Mini

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-01

Metriek DeepSeek V4 Flash DeepSeek V4 Flash high Releasedatum: 2026-04-24 GPT-5 Mini GPT-5 Mini medium Releasedatum: 2025-08-07
Score 7.6 7.2
Rang #45 #73
Betrouwbaarheid 10.0 10.0
Consistentie 8.4 9.1
Correcte tests
Slaagpercentage per poging 73.3% 61.7%
Instabiele tests 4 2
Totaal runs 60 60
Kosten per resultaat 0.309 1.348
Totale kosten $0.027 $0.149
Invoerprijs $0.099 / 1M $0.250 / 1M
Uitvoerprijs $0.197 / 1M $2.000 / 1M
Uitvoer-tokens 10,302 6,723
Redeneer-tokens 115,740 63,082
Responstijd (gem.) 46.36s 23.75s
Responstijd (max) 218.13s 88.15s
Responstijd (totaal) 927.27s 475.03s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
GPT-5 Mini 7.1 7.6 66.7% 1 13.86s 1,715 6,378
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 6.8 10.0 50.0% 0 58.13s 387 27,101
GPT-5 Mini 10.0 10.0 100.0% 0 30.74s 580 12,544
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
GPT-5 Mini 10.0 10.0 100.0% 0 88.15s 754 11,520
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
GPT-5 Mini 10.0 10.0 100.0% 0 12.58s 453 3,200
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 27 59,249
GPT-5 Mini 3.6 7.2 22.2% 1 44.63s 293 14,016
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
GPT-5 Mini 4.5 10.0 0.0% 0 13.50s 349 1,856
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
GPT-5 Mini 10.0 10.0 100.0% 0 11.59s 310 3,968
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 8.2 7.2 88.9% 1 26.11s 196 1,767
GPT-5 Mini 5.6 9.8 33.3% 0 15.20s 1,622 6,144
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542
GPT-5 Mini 10.0 10.0 100.0% 0 18.64s 487 1,600
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Flash 3.0 10.0 0.0% 0 54.46s 8,516 8,531
GPT-5 Mini 3.0 10.0 0.0% 0 9.99s 160 1,856

Snelle vergelijking

Vergelijkingspaar wisselen