Rezumat
Grok Build 0.1 obține 4.0 pe AI BENCHY și este pe #276. Are fiabilitate 10.0, rată de reușită 43.9%, cost total $0.547 și timp mediu de răspuns 28.69s.
Ce face Grok Build 0.1 unic: Se remarcă cel mai mult la Trucuri anti-AI, unde este pe #1, iar Combinat este zona cea mai slabă, la #8.
Model arhivat: acest model nu mai este actualizat și nu mai este testat pe teste noi.
Date despre model
Documentat la 2026-08-12
- Parametri
- ~300B în total (~30B activi)
- Arhitectură
- MoE
- Disponibilitate
- Închis
- Licență
- -
Cea mai bună estimare bazată pe informații publice; furnizorul nu a dezvăluit toate valorile.
4.0
Consistență
7.2
10.0
$0.547
Total tokenuri de ieșire
267,275
Total tokenuri de intrare
11,793
Preț de intrare
$1.000 / 1M
Preț de ieșire
$2.000 / 1M
Teste instabile
4
Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).
Istoric rulări
| Testat la | Scor | Fiabilitate | Teste corecte | Cost total | Compară |
|---|---|---|---|---|---|
| 2026-05-21 12:40 Retestare | 4.0 | 10.0 | $0.547 | Rularea curentă | |
| 2026-05-21 12:40 Retestare | 4.0 | 10.0 | $0.547 | Compară | |
| 2026-05-21 12:40 Retestare | 6.0 | 10.0 | $0.547 | Compară | |
| 2026-05-21 12:40 Retestare | 6.6 | 10.0 | $0.547 | Compară |
Comparație între rulări
| Rulare | Acoperire benchmark | Scor | Consistență | Fiabilitate | Teste corecte | Teste instabile | Total tokenuri de ieșire | Total tokenuri de intrare | Cost total | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|---|---|---|
| 2026-05-21 12:40 · Rularea curentă | 57/66 încercări | 4.0 | 7.2 | 10.0 | 7/19 | 4 | 267,275 | 11,793 | $0.547 | 28.69s |
| 2026-05-21 12:40 · Retestare | 57/57 încercări | 6.6 | 8.0 | 10.0 | 7/16 | 4 | 267,275 | 0 | $0.547 | 28.69s |
| Diferență | — | -2.7 | -0.8 | 0.0 | -3 | 0 | 0 | +11793 | $0.000 | 0ms |
Istoric prețuri
Date istorice de preț pentru acest model de la OpenRouter.
| Dată | Preț de intrare | Preț de ieșire |
|---|---|---|
| 2026-06-04 15:40 | $1.000 / 1M | $2.000 / 1M |
Grafice
Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.
Scor vs Cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Defalcare pe categorii
| Categorie | Scor | Consistență | Teste corecte |
|---|---|---|---|
| Trucuri anti-AI | 8.7 | 7.9 | |
| Programare | 3.3 | 3.3 | |
| Combinat | 1.5 | 5.0 | |
| Parsare și extragere de date | 3.8 | 5.8 | |
| Specific domeniului | 3.6 | 7.2 | |
| Inteligență generală | 4.3 | 10.0 | |
| Respectarea instrucțiunilor | 9.8 | 10.0 | |
| Rezolvare de puzzle-uri | 6.4 | 7.7 | |
| Apelare instrumente | 3.0 | 10.0 | |
| Cultură generală | 3.0 | 10.0 |