Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs inclusionAI: Ring-2.6-1T

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-22

Metriek Claude Opus 4.7 Claude Opus 4.7 medium Releasedatum: 2026-04-16 Ring-2.6-1T Ring-2.6-1T medium Releasedatum: 2026-05-10
Score 8.9 7.2
Rang #7 #61
Betrouwbaarheid 10.0 9.9
Consistentie 10.0 8.7
Correcte tests
Slaagpercentage per poging 85.0% 66.7%
Instabiele tests 0 3
Totaal runs 60 60
Kosten per resultaat 3.674 0.000
Totale kosten $0.625 $0.000
Invoerprijs $5.000 / 1M $0.075 / 1M
Uitvoerprijs $25.000 / 1M $0.625 / 1M
Uitvoer-tokens 10,468 21,752
Redeneer-tokens 2,198 42,754
Responstijd (gem.) 4.50s 61.29s
Responstijd (max) 23.18s 304.19s
Responstijd (totaal) 85.46s 1164.50s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 8.3 10.0 75.0% 0 1.85s 348 0
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 14.79s 6,210 1,114
Ring-2.6-1T 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 21.45s 2,369 1,084
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 324 6,088
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.37s 324 0
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 840 1,937
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 7.7 10.0 66.7% 0 1.17s 51 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.87s 256 0
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 150 583
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 1.57s 114 0
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 266 1,831
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 2.51s 399 0
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 697 2,479
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 10.0 10.0 100.0% 0 4.17s 373 0
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 234 1,531
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Claude Opus 4.7 3.0 10.0 0.0% 0 2.25s 24 0
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 4,295 4,416

Snelle vergelijking

Vergelijkingspaar wisselen