Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Sonnet 4.6

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-16

Metriek Claude Opus 4.7 Claude Opus 4.7 medium Releasedatum: 2026-04-16 Claude Sonnet 4.6 Claude Sonnet 4.6 medium Releasedatum: 2026-02-17
Score 9.2 8.0
Rang #3 #26
Consistentie 10.0 9.5
Correcte tests
Slaagpercentage per poging 88.9% 74.1%
Instabiele tests 0 1
Totaal runs 54 54
Kosten per resultaat 2.790 8.930
Totale kosten $0.447 $1.161
Invoerprijs $5.000 / 1M $3.000 / 1M
Uitvoerprijs $25.000 / 1M $15.000 / 1M
Uitvoer-tokens 5,375 42,068
Redeneer-tokens 1,341 26,784
Responstijd (gem.) 3.53s 12.66s
Responstijd (max) 21.45s 46.35s
Responstijd (totaal) 60.03s 126.62s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 6.41s 1,141 257
Claude Sonnet 4.6 10.0 10.0 100.0% 0 35.76s 6,894 2,097
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351

Snelle vergelijking

Vergelijkingspaar wisselen