Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs DeepSeek: DeepSeek V3.2

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-30

Metriek Claude Sonnet 4.6 Claude Sonnet 4.6 medium Releasedatum: 2026-02-17 DeepSeek V3.2 DeepSeek V3.2 medium Releasedatum: 2025-12-01
Score 8.0 8.0
Rang #36 #37
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 9.5 8.2
Correcte tests
Slaagpercentage per poging 74.1% 79.6%
Instabiele tests 1 4
Totaal runs 54 52
Kosten per resultaat 8.930 0.231
Totale kosten $1.161 $0.028
Invoerprijs $3.000 / 1M $0.252 / 1M
Uitvoerprijs $15.000 / 1M $0.378 / 1M
Uitvoer-tokens 42,068 7,554
Redeneer-tokens 26,784 45,588
Responstijd (gem.) 12.66s 43.49s
Responstijd (max) 46.35s 180.92s
Responstijd (totaal) 126.62s 782.73s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
DeepSeek V3.2 8.4 9.9 75.0% 0 30.72s 3,773 7,523
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
DeepSeek V3.2 5.3 7.2 44.4% 1 21.78s 15 4,933
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859

Snelle vergelijking

Vergelijkingspaar wisselen