Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs OpenAI: GPT-5.2

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-29

Metriek Seed-2.0-Mini Seed-2.0-Mini medium Releasedatum: 2026-02-14 GPT-5.2 GPT-5.2 medium Releasedatum: 2025-12-11
Score 7.1 7.3
Rang #75 #63
Betrouwbaarheid 10.0 10.0
Consistentie 9.2 8.3
Correcte tests
Slaagpercentage per poging 60.0% 70.0%
Instabiele tests 2 4
Totaal runs 60 60
Kosten per resultaat 0.397 4.094
Totale kosten $0.044 $0.492
Invoerprijs $0.100 / 1M $1.750 / 1M
Uitvoerprijs $0.400 / 1M $14.000 / 1M
Uitvoer-tokens 2,555 2,880
Redeneer-tokens 95,974 28,289
Responstijd (gem.) 80.22s 16.50s
Responstijd (max) 262.83s 77.80s
Responstijd (totaal) 1363.72s 214.45s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 6.6 10.0 50.0% 0 74.75s 360 9,520
GPT-5.2 6.5 8.0 58.3% 1 7.81s 567 2,002
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 7.1 9.8 50.0% 0 220.48s 464 34,964
GPT-5.2 10.0 10.0 100.0% 0 23.15s 490 8,269
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 262.83s 404 29,806
GPT-5.2 10.0 10.0 100.0% 0 14.06s 291 1,757
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 24.27s 246 2,743
GPT-5.2 10.0 10.0 100.0% 0 3.15s 234 420
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.2 5.9 7.2 55.6% 1 77.80s 42 10,342
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 5.1 3.4 33.3% 1 36.65s 213 4,210
GPT-5.2 3.7 9.7 0.0% 0 4.32s 162 269
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 17.47s 69 2,050
GPT-5.2 9.9 10.0 100.0% 0 3.12s 94 614
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 8.2 7.2 88.9% 1 31.79s 527 5,667
GPT-5.2 7.5 7.3 77.8% 1 5.80s 735 924
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 10.0 10.0 100.0% 0 88.68s 222 5,235
GPT-5.2 4.7 1.6 66.7% 1 10.30s 239 469
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Mini 3.0 10.0 0.0% 0 56.76s 50 1,779
GPT-5.2 3.0 10.0 0.0% 0 28.18s 26 3,223

Snelle vergelijking

Vergelijkingspaar wisselen