Navigare
Advertise here

KAT-Coder-Pro V2.5 (low) vs GLM 5.3 (low)

KAT-Coder-Pro V2.5 (low) conduce la scorul mediu cu 6.5 vs 6.5. GLM 5.3 (low) are costul de benchmark mai mic, $0.471 vs $0.568. GLM 5.3 (low) este mai rapid cu 15.18s vs 19.40s, cu rate de reușită de 65.2% vs 63.8%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-03

Modele comparate

Rang
#194
Total tokenuri de ieșire
113,193
Timp de răspuns (mediu)
19.40s
Cost total
$0.568
Rang
#199
Total tokenuri de ieșire
28,106
Timp de răspuns (mediu)
15.18s
Cost total
$0.471
Model recomandat GLM 5.3 (low)

Oferă cel mai bun compromis per total: scor competitiv (6.5), cost mai mic decât KAT-Coder-Pro V2.5 (low) și timp de răspuns echilibrat.

Comparație detaliată

Metrică KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low Lansare: 2026-07-14 GLM 5.3 GLM 5.3 low Lansare: 2026-08-20
Scor 6.5 6.5
Rang #194 #199
Fiabilitate 10.0 10.0
Consistență 7.1 8.3
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 65.2% 63.8%
Teste instabile 8 5
Rulări totale 69 69
Cost per rezultat 3.636 3.923
Cost total $0.568 $0.471
Preț de intrare $0.740 / 1M $1.400 / 1M
Preț de ieșire $2.960 / 1M $4.400 / 1M
Preț citire cache $0.150 / 1M $0.140 / 1M
Preț scriere cache N/D N/D
Total tokenuri de intrare 87,682 247,871
Tokenuri de ieșire 7,166 10,791
Tokenuri de raționament 106,027 17,315
Timp de răspuns (mediu) 19.40s 15.18s
Timp de răspuns (maxim) 209.15s 83.60s
Timp de răspuns (total) 446.11s 349.06s
Parametri ~700B în total (~72B activi) 744B în total (40B activi)
Disponibilitate Închis Închis

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#194 KAT-Coder-Pro V2.5

low
Cost
$0.016
Timp
47.6s
Tokenuri
5,182 tok

#199 GLM 5.3

low
Cost
$0.007
Timp
28.4s
Tokenuri
1,599 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

Comparație rapidă

Schimbă perechea de comparație