- Scor
- 9.4 (+2.97 puncte)
- Cost total (preț curent)
- $0.183 · cu 78.3% mai ieftin
- Timp de răspuns (mediu)
- 6.24s · cu 95.0% mai rapid
Rezumat
Kimi K2.5 obține 6.4 pe AI BENCHY și este pe #208. Are fiabilitate 9.6, rată de reușită 60.9%, cost total $0.841 și timp mediu de răspuns 125.76s.
Ce face Kimi K2.5 unic: Se remarcă cel mai mult la Respectarea instrucțiunilor, unde este pe #1, iar Specific domeniului este zona cea mai slabă, la #15.
Alternative recomandate
Recomandăm să alegi unul dintre aceste modele în schimb:
- Scor
- 6.8 (+0.41 puncte)
- Cost total (preț curent)
- $0.039 · cu 95.4% mai ieftin
- Timp de răspuns (mediu)
- 6.66s · cu 94.7% mai rapid
- Scor
- 8.3 (+1.87 puncte)
- Cost total (preț curent)
- $0.047 · cu 94.4% mai ieftin
- Timp de răspuns (mediu)
- 18.07s · cu 85.6% mai rapid
Date despre model
Documentat la 2026-08-12
- Parametri
- 1T în total (32B activi)
- Arhitectură
- MoE
- Disponibilitate
- Ponderi disponibile
- Licență
- Modified MIT
6.4
Consistență
7.1
9.6
Total tokenuri de ieșire
241,096
Total tokenuri de intrare
292,271
Preț de intrare
$0.450 / 1M
Preț de ieșire
$2.250 / 1M
Preț citire cache
$0.070 / 1M
Preț scriere cache
N/D
Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.
Teste instabile
8
Testele instabile au avut rezultate mixte între rulări (cel puțin un succes și un eșec).
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#208 MoonshotAI: Kimi K2.5
medium- Cost
- $0.030
- Timp
- 58.6s
- Tokenuri
- 8,683 tok
Istoric rulări
| Testat la | Scor | Fiabilitate | Teste corecte | Cost total | Compară |
|---|---|---|---|---|---|
| 2026-10-01 01:36 Retestare | 6.4 | 9.6 | $0.841 ↑ | Rularea curentă | |
| 2026-07-16 22:17 Test nou adăugat | 7.0 | 10.0 | $0.600 ↑ | Compară | |
| 2026-06-04 13:43 Test nou adăugat | 6.8 | 10.0 | $0.328 ↓ | Compară | |
| 2026-05-22 00:12 Suită modificată | 6.7 | 10.0 | $0.314 | Compară | |
| 2026-04-20 17:48 Prima rulare înregistrată | 7.0 | N/D | $0.220 | Compară |
Această rulare a folosit o suită de benchmark diferită. Ține cont de schimbările suitei când interpretezi evoluția istorică.
Istoric prețuri
Date istorice de preț pentru acest model de la OpenRouter.
| Dată | Preț de intrare | Preț de ieșire | Preț citire cache | Preț scriere cache |
|---|---|---|---|---|
| 2026-06-04 15:40 | $0.400 / 1M | $1.900 / 1M | N/D | N/D |
| 2026-06-17 10:07 | $0.375 / 1M | $2.025 / 1M | N/D | N/D |
| 2026-08-14 12:51 | $0.571 / 1M | $2.850 / 1M | N/D | N/D |
| 2026-10-01 18:33 | $0.450 / 1M | $2.250 / 1M | $0.070 / 1M | N/D |
Grafice
Alege primul model, apoi fă clic pe al doilea model pentru a deschide o pagină alăturată.
Top modele după scor
Scor vs Cost total
Timp de răspuns (mediu)
Scor vs Timp de răspuns (mediu)
Total tokenuri de ieșire
Scor vs Total tokenuri de ieșire
Comparație rapidă
Defalcare pe categorii
| Categorie | Scor | Consistență | Teste corecte |
|---|---|---|---|
| Sarcini agentice | 3.9 | 9.6 | |
| Trucuri anti-AI | 7.3 | 5.8 | |
| Programare | 6.1 | 4.6 | |
| Combinat | 6.7 | 9.1 | |
| Parsare și extragere de date | 10.0 | 10.0 | |
| Specific domeniului | 2.9 | 4.4 | |
| Inteligență generală | 6.5 | 3.4 | |
| Respectarea instrucțiunilor | 10.0 | 10.0 | |
| Rezolvare de puzzle-uri | 5.3 | 7.3 | |
| Apelare instrumente | 10.0 | 10.0 | |
| Cultură generală | 3.0 | 10.0 |