Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-15

Metriek Seed-2.0-Lite Seed-2.0-Lite medium Releasedatum: 2026-02-14 GLM 5 GLM 5 medium Releasedatum: 2026-02-12
Rang #3 #13
Score 8.8 8.2
Consistentie 8.7 8.0
Kosten per resultaat 0.870 0.933
Totale kosten $0.105 $0.103
Correcte tests
Slaagpercentage per poging 87.5% 83.3%
Instabiele tests 3 4
Totaal runs 48 48
Uitvoer-tokens 2,815 19,773
Redeneer-tokens 44,618 36,459
Responstijd (gem.) 29.39s 16.16s
Responstijd (max) 168.71s 28.96s
Responstijd (totaal) 470.29s 129.26s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 10.0 10.0 100.0% 0 23.34s 990 7,037
GLM 5 10.0 10.0 100.0% 0 22.26s 420 4,992
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 506 4,299
GLM 5 10.0 10.0 100.0% 0 28.96s 662 3,242
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 246 1,742
GLM 5 7.1 5.6 83.3% 1 8.90s 567 3,734
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 15 23,897
GLM 5 3.5 4.4 33.3% 2 0ms 13,176 14,137
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 304 1,620
GLM 5 6.1 3.1 66.7% 1 14.69s 2,020 2,248
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 71 1,480
GLM 5 10.0 10.0 100.0% 0 7.25s 1,001 2,129
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 9.0 7.9 88.9% 1 11.03s 461 3,532
GLM 5 10.0 10.0 100.0% 0 15.64s 1,694 4,983
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 222 1,011
GLM 5 10.0 10.0 100.0% 0 15.93s 233 994

Snelle vergelijking

Vergelijkingspaar wisselen