Navigare
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Seed-2.0-Lite (medium) vs GLM 5 (medium)

Scorul mediu este practic egal la 7.8 vs 7.7. GLM 5 (medium) are costul de benchmark mai mic, $0.228 vs $0.236. GLM 5 (medium) este mai rapid cu 33.54s vs 47.94s, cu rate de reușită de 69.7% vs 78.8%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-08-15

Rang
#69
Total tokenuri de ieșire
101,296
Timp de răspuns (mediu)
47.94s
Cost total
$0.236
Rang
#72
Total tokenuri de ieșire
124,566
Timp de răspuns (mediu)
33.54s
Cost total
$0.228
Model recomandat GLM 5 (medium)

Are cel mai puternic scor din această comparație (7.7) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.

Comparație detaliată

Metrică Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14 GLM 5 GLM 5 medium Lansare: 2026-02-12
Scor 7.8 7.7
Rang #69 #72
Fiabilitate 10.0 10.0
Consistență 8.6 8.1
Încercări 66/66 63/66
Teste corecte
Rată de trecere pe încercare 69.7% 78.8%
Teste instabile 4 4
Rulări totale 66 63
Cost per rezultat 1.809 1.668
Cost total $0.236 $0.228
Preț de intrare $0.250 / 1M $0.600 / 1M
Preț de ieșire $2.000 / 1M $1.920 / 1M
Total tokenuri de intrare 129,906 35,224
Tokenuri de ieșire 12,530 21,570
Tokenuri de raționament 88,766 102,996
Timp de răspuns (mediu) 47.94s 33.54s
Timp de răspuns (maxim) 254.92s 99.85s
Timp de răspuns (total) 1054.57s 435.99s
Parametri ~200B în total (~20B activi) 744B în total (40B activi)
Disponibilitate Închis Sursă deschisă

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#69 Seed-2.0-Lite

medium
Cost
$0.005
Timp
86.7s
Tokenuri
2,354 tok

#72 GLM 5

medium
Cost
$0.005
Timp
20.7s
Tokenuri
2,068 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Seed-2.0-Lite 8.0 9.8 66.7% 0 156.74s 8,247 458 31,890
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

Comparație rapidă

Schimbă perechea de comparație