Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs inclusionAI: Ring-2.6-1T

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-29

Metriek Seed-2.0-Mini Seed-2.0-Mini medium Releasedatum: 2026-02-14 Ring-2.6-1T Ring-2.6-1T medium Releasedatum: 2026-05-10
Score 7.1 7.2
Rang #75 #69
Betrouwbaarheid 10.0 10.0
Consistentie 9.2 8.7
Correcte tests
Slaagpercentage per poging 60.0% 66.7%
Instabiele tests 2 3
Totaal runs 60 60
Kosten per resultaat 0.397 0.000
Totale kosten $0.044 $0.000
Invoerprijs $0.100 / 1M $0.075 / 1M
Uitvoerprijs $0.400 / 1M $0.625 / 1M
Uitvoer-tokens 2,555 21,752
Redeneer-tokens 95,974 42,754
Responstijd (gem.) 80.22s 61.29s
Responstijd (max) 262.83s 304.19s
Responstijd (totaal) 1363.72s 1164.50s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 360 9,520
Ring-2.6-1T 10.0 10.0 100.0% 0 42.21s 3,833 4,891
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 7.1 9.8 50.0% 0 220.48s 464 34,964
Ring-2.6-1T 10.0 10.0 100.0% 0 59.65s 1,369 3,985
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 404 29,806
Ring-2.6-1T 10.0 10.0 100.0% 0 304.19s 324 6,088
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 246 2,743
Ring-2.6-1T 6.5 10.0 50.0% 0 37.36s 840 1,937
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0
Ring-2.6-1T 3.5 4.4 33.3% 2 64.92s 9,744 15,013
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 213 4,210
Ring-2.6-1T 4.1 10.0 0.0% 0 58.26s 150 583
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 69 2,050
Ring-2.6-1T 9.8 10.0 100.0% 0 11.78s 266 1,831
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 527 5,667
Ring-2.6-1T 5.9 7.2 55.6% 1 20.73s 697 2,479
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 222 5,235
Ring-2.6-1T 10.0 10.0 100.0% 0 104.44s 234 1,531
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 50 1,779
Ring-2.6-1T 3.0 10.0 0.0% 0 113.91s 4,295 4,416

Snelle vergelijking

Vergelijkingspaar wisselen