Navigare
Advertise here

LongCat 2.0 (low) vs GLM 5.3 Flash (low)

Scorul mediu este practic egal la 6.6 vs 6.6. GLM 5.3 Flash (low) are costul de benchmark mai mic, $0.038 vs $0.630. GLM 5.3 Flash (low) este mai rapid cu 11.82s vs 115.00s, cu rate de reușită de 55.1% vs 58.0%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-09

Modele comparate

Rang
#201
Total tokenuri de ieșire
346,225
Timp de răspuns (mediu)
115.00s
Cost total
$0.630
Rang
#197
Total tokenuri de ieșire
27,168
Timp de răspuns (mediu)
11.82s
Cost total
$0.038
Model recomandat GLM 5.3 Flash (low)

Are cel mai bun scor aici (6.6) și costă de aproximativ 17.0x mai puțin decât LongCat 2.0 (low).

Comparație detaliată

Metrică LongCat 2.0 LongCat 2.0 low Lansare: 2026-07-20 GLM 5.3 Flash GLM 5.3 Flash low Lansare: 2026-08-26
Scor 6.6 6.6
Rang #201 #197
Fiabilitate 9.9 10.0
Consistență 8.3 8.5
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 55.1% 58.0%
Teste instabile 5 4
Rulări totale 69 69
Cost per rezultat 4.942 0.338
Cost total $0.630 $0.038
Preț de intrare $0.300 / 1M $0.150 / 1M
Preț de ieșire $1.200 / 1M $0.500 / 1M
Preț citire cache $0.006 / 1M $0.030 / 1M
Preț scriere cache N/D N/D
Total tokenuri de intrare 262,387 255,173
Tokenuri de ieșire 7,344 9,891
Tokenuri de raționament 338,881 17,277
Timp de răspuns (mediu) 115.00s 11.82s
Timp de răspuns (maxim) 560.39s 90.45s
Timp de răspuns (total) 2645.11s 271.92s
Parametri 1.6T în total (48B activi) 320B în total (18B activi)
Disponibilitate Sursă deschisă Sursă deschisă

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#201 LongCat 2.0

low
Cost
$0.024
Timp
428.0s
Tokenuri
19,557 tok

#197 GLM 5.3 Flash

low
Cost
$0.001
Timp
20.7s
Tokenuri
1,482 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.3 Flash 5.4 7.2 44.4% 1 10.38s 7,317 398 3,973

Schimbă perechea de comparație