Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs DeepSeek: DeepSeek V4 Flash

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-25

Metriek Claude Sonnet 4.6 Claude Sonnet 4.6 medium Releasedatum: 2026-02-17 DeepSeek V4 Flash DeepSeek V4 Flash high Releasedatum: 2026-04-24
Score 8.0 7.8
Rang #31 #36
Betrouwbaarheid n.v.t. 10.0
Consistentie 9.5 7.8
Correcte tests
Slaagpercentage per poging 74.1% 79.6%
Instabiele tests 1 5
Totaal runs 54 54
Kosten per resultaat 8.930 0.277
Totale kosten $1.161 $0.031
Invoerprijs $3.000 / 1M $0.140 / 1M
Uitvoerprijs $15.000 / 1M $0.280 / 1M
Uitvoer-tokens 42,068 1,765
Redeneer-tokens 26,784 90,299
Responstijd (gem.) 12.66s 45.41s
Responstijd (max) 46.35s 218.13s
Responstijd (totaal) 126.62s 817.30s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
DeepSeek V4 Flash 10.0 10.0 100.0% 0 62.48s 369 9,361
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 27 59,249
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
DeepSeek V4 Flash 6.4 4.5 77.8% 2 25.53s 193 2,597
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542

Snelle vergelijking

Vergelijkingspaar wisselen