#268 GLM 5
none- Cost
- $0.007
- Timp
- 32.1s
- Tokenuri
- 2,023 tok
Rezumat
GLM 5 obține 5.6 pe AI BENCHY și este pe #268. Are fiabilitate 10.0, rată de reușită 40.6%, cost total $0.140 și timp mediu de răspuns 8.74s.
Ce face GLM 5 unic: Se remarcă cel mai mult la Inteligență generală, unde este pe #1, iar Combinat este zona cea mai slabă, la #16.
Documentat la 2026-08-12
5.6
Consistență
9.3
10.0
Total tokenuri de ieșire
5,577
Total tokenuri de intrare
190,675
Preț de intrare
$0.600 / 1M
Preț de ieșire
$1.920 / 1M
Preț citire cache
$0.120 / 1M
Preț scriere cache
N/D
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Teste greșite: 13
Rată de trecere pe încercare: 40.6%
Acoperire benchmark: 66/69 încercări (Țintă: 3 repetări per test)
Teste instabile
1
Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
Istoric rulări
| Testat la | Scor | Fiabilitate | Teste corecte | Cost total | Compară |
|---|---|---|---|---|---|
| 2026-10-01 05:14 Retestare | 5.6 | 10.0 | $0.140 ↑ | Rularea curentă | |
| 2026-06-04 13:05 Retestare | 5.7 | 10.0 | $0.042 ↑ | Compară | |
| 2026-06-04 13:05 Test nou adăugat | 6.1 | 10.0 | $0.027 ↑ | Compară | |
| 2026-05-21 23:41 Suită modificată | 6.3 | 10.0 | $0.023 | Compară | |
| 2026-04-22 12:55 Prima rulare înregistrată | 6.6 | N/D | $0.020 | Compară |
Comparație între rulări
| Rulare | Acoperire benchmark | Scor | Consistență | Fiabilitate | Teste corecte | Teste instabile | Total tokenuri de ieșire | Total tokenuri de intrare | Cost total | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-10-01 05:14 · Rularea curentă | 66/69 încercări | 5.6 | 9.3 | 10.0 | 9/22 | 1 | 5,577 | 190,675 | $0.140 | 8.74s |
| 2026-06-04 13:05 · Retestare | 63/63 încercări | 5.7 | 9.3 | 10.0 | 9/21 | 1 | 1,989 | 37,135 | $0.042 | 4.03s |
| Diferență | — | -0.1 | 0.0 | 0.0 | 0 | 0 | +3588 | +153540 | +$0.099 | +4718ms |
Acoperirea benchmark diferă: 66/69 încercări (Țintă: 3 repetări per test) față de 63/63 încercări (Țintă: 3 repetări per test). Totalurile și metricile sensibile la repetări nu sunt direct comparabile.
Istoric prețuri
Date istorice de preț pentru acest model de la OpenRouter.
| Dată | Preț de intrare | Preț de ieșire | Preț citire cache | Preț scriere cache |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.600 / 1M | $1.920 / 1M | N/D | N/D |
| 2026-07-16 15:36 | $0.950 / 1M | $3.150 / 1M | N/D | N/D |
| 2026-07-20 15:56 | $0.950 / 1M | $2.551 / 1M | N/D | N/D |
| 2026-10-01 18:33 | $0.600 / 1M | $1.920 / 1M | $0.120 / 1M | N/D |
Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.
| Categorie | Scor | Consistență | Teste corecte |
|---|---|---|---|
| Sarcini agentice | 5.0 | 10.0 | |
| Trucuri anti-AI | 4.8 | 10.0 | |
| Programare | 4.0 | 7.8 | |
| Combinat | 1.5 | 5.0 | |
| Parsare și extragere de date | 10.0 | 10.0 | |
| Specific domeniului | 3.0 | 10.0 | |
| Inteligență generală | 10.0 | 10.0 | |
| Respectarea instrucțiunilor | 10.0 | 10.0 | |
| Rezolvare de puzzle-uri | 7.7 | 10.0 | |
| Apelare instrumente | 10.0 | 10.0 | |
| Cultură generală | 3.0 | 10.0 |