Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Anthropic: Claude Opus 4.8

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-28

Metriek Claude Opus 4.7 Claude Opus 4.7 medium Releasedatum: 2026-04-16 Claude Opus 4.8 Claude Opus 4.8 medium Releasedatum: 2026-05-28
Score 8.9 8.7
Rang #7 #12
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 9.6
Correcte tests
Slaagpercentage per poging 85.0% 83.3%
Instabiele tests 0 1
Totaal runs 60 60
Kosten per resultaat 3.670 6.285
Totale kosten $0.624 $1.006
Invoerprijs $5.000 / 1M $5.000 / 1M
Uitvoerprijs $25.000 / 1M $25.000 / 1M
Uitvoer-tokens 10,439 23,201
Redeneer-tokens 2,198 5,901
Responstijd (gem.) 4.48s 9.34s
Responstijd (max) 23.18s 38.03s
Responstijd (totaal) 85.21s 186.84s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 1,179 478
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 14.79s 6,210 1,114
Claude Opus 4.8 10.0 10.0 100.0% 0 14.97s 6,651 1,381
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Claude Opus 4.8 9.8 10.0 100.0% 0 38.03s 5,260 1,588
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Claude Opus 4.8 7.1 5.6 83.3% 1 12.29s 481 312
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Claude Opus 4.8 5.3 10.0 33.3% 0 14.15s 7,477 900
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Claude Opus 4.8 10.0 10.0 100.0% 0 2.46s 237 0
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Claude Opus 4.8 10.0 10.0 100.0% 0 3.32s 373 320
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.43s 370 0
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 791 483
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Claude Opus 4.8 10.0 10.0 100.0% 0 8.96s 301 225
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 3.0 10.0 0.0% 0 2.25s 24 0
Claude Opus 4.8 3.0 10.0 0.0% 0 6.14s 451 214

Snelle vergelijking

Vergelijkingspaar wisselen