- Scor
- 9.4 (+2.90 puncte)
- Cost total (preț curent)
- $0.183 · cu 59.6% mai ieftin
- Timp de răspuns (mediu)
- 6.24s · cu 43.8% mai rapid
Rezumat
GLM 5.1 obține 6.5 pe AI BENCHY și este pe #203. Are fiabilitate 10.0, rată de reușită 47.8%, cost total $0.451 și timp mediu de răspuns 11.10s.
Ce face GLM 5.1 unic: Se remarcă cel mai mult la Sarcini agentice, unde este pe #1, iar Trucuri anti-AI este zona cea mai slabă, la #16.
Alternative recomandate
Recomandăm să alegi unul dintre aceste modele în schimb:
- Scor
- 9.6 (+3.10 puncte)
- Cost total (preț curent)
- $0.460 · cu 1.8% mai scump
- Timp de răspuns (mediu)
- 7.15s · cu 35.6% mai rapid
- Scor
- 6.8 (+0.35 puncte)
- Cost total (preț curent)
- $0.039 · cu 91.5% mai ieftin
- Timp de răspuns (mediu)
- 6.66s · cu 40.0% mai rapid
Date despre model
Documentat la 2026-08-12
- Parametri
- 744B în total (40B activi)
- Arhitectură
- MoE
- Disponibilitate
- Sursă deschisă
- Licență
- MIT
6.5
Consistență
8.2
10.0
Total tokenuri de ieșire
20,076
Total tokenuri de intrare
258,956
Preț de intrare
$1.400 / 1M
Preț de ieșire
$4.400 / 1M
Preț citire cache
$0.260 / 1M
Preț scriere cache
N/D
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Teste instabile
5
Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#203 GLM 5.1
none- Cost
- $0.000
- Timp
- 300.0s
- Tokenuri
- 0 tok
Istoric rulări
| Testat la | Scor | Fiabilitate | Teste corecte | Cost total | Compară |
|---|---|---|---|---|---|
| 2026-10-01 00:00 Retestare | 6.5 | 10.0 | $0.451 ↑ | Rularea curentă | |
| 2026-07-16 21:16 Test nou adăugat | 5.5 | 10.0 | $0.164 ↓ | Compară | |
| 2026-06-04 13:04 Test nou adăugat | 5.7 | 10.0 | $0.058 ↓ | Compară | |
| 2026-05-21 23:41 Suită modificată | 5.6 | 10.0 | $0.057 | Compară | |
| 2026-05-08 13:04 Suită modificată | 5.7 | 10.0 | $0.053 | Compară | |
| 2026-05-08 13:04 Suită modificată | 5.7 | 10.0 | $0.053 | Compară | |
| 2026-04-22 12:55 Prima rulare înregistrată | 5.6 | N/D | $0.053 | Compară |
Această rulare a folosit o suită de benchmark diferită. Ține cont de schimbările suitei când interpretezi evoluția istorică.
Istoric prețuri
Date istorice de preț pentru acest model de la OpenRouter.
| Dată | Preț de intrare | Preț de ieșire | Preț citire cache | Preț scriere cache |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.980 / 1M | $3.080 / 1M | N/D | N/D |
| 2026-06-30 21:25 | $0.975 / 1M | $4.301 / 1M | N/D | N/D |
| 2026-07-08 21:00 | $0.966 / 1M | $3.036 / 1M | N/D | N/D |
| 2026-08-05 23:12 | $0.952 / 1M | $2.992 / 1M | N/D | N/D |
| 2026-08-14 12:51 | $1.400 / 1M | $4.400 / 1M | N/D | N/D |
| 2026-10-03 09:03 | $1.400 / 1M | $4.400 / 1M | $0.260 / 1M | N/D |
Grafice
Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.
Top modele după scor
Scor vs Cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Comparație rapidă
Defalcare pe categorii
| Categorie | Scor | Consistență | Teste corecte |
|---|---|---|---|
| Sarcini agentice | 10.0 | 10.0 | |
| Trucuri anti-AI | 4.0 | 6.3 | |
| Programare | 3.9 | 9.7 | |
| Combinat | 2.8 | 1.8 | |
| Parsare și extragere de date | 10.0 | 10.0 | |
| Specific domeniului | 5.3 | 7.2 | |
| Inteligență generală | 5.0 | 10.0 | |
| Respectarea instrucțiunilor | 9.8 | 10.0 | |
| Rezolvare de puzzle-uri | 7.7 | 10.0 | |
| Apelare instrumente | 10.0 | 10.0 | |
| Cultură generală | 3.0 | 10.0 |