Clasament Respectarea instrucțiunilor
Vezi ce modele AI se descurcă cel mai bine la Respectarea instrucțiunilor, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Timp de răspuns (mediu) ↓.
Modele afișate
15
Media pentru Scor Respectarea instrucțiunilor
8.6
Cel mai bun model
Kimi K2.5 10.0
216/216
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Respectarea instrucțiunilor | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #106 | Hy3 preview medium | Tencent | 10.0 | 6.5 | $0.018 | 2/2 | 6.16s |
| #51 | MiniMax M3 medium | Minimax | 9.8 | 7.6 | $0.286 | 2/2 | 6.14s |
| #25 | Grok 4.5 medium | X AI | 9.8 | 8.3 | $1.928 | 2/2 | 6.06s |
| #89 | Qwen3.6 Flash medium | Qwen | 10.0 | 6.9 | $0.738 | 2/2 | 6.05s |
| #20 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.478 | 2/2 | 5.90s |
| #210 | Qwen3.5-9B medium | Qwen | 6.5 | 3.8 | $0.036 | 1/2 | 5.75s |
| #184 | Ling-2.6-flash none | Inclusionai | 9.8 | 4.9 | $0.002 | 2/2 | 5.52s |
| #34 | GPT-5.2 Chat none | OpenAI | 9.8 | 8.0 | $0.604 | 2/2 | 5.51s |
| #27 | Muse Spark 1.1 low | Meta | 7.3 | 8.3 | $0.647 | 1/2 | 5.42s |
| #56 | Kimi K2.7 Code medium | Moonshot AI | 9.9 | 7.5 | $0.740 | 2/2 | 5.39s |
| #53 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |
| #168 | Ling-2.6-1T none | Inclusionai | 6.4 | 5.3 | $0.016 | 1/2 | 5.36s |
| #212 | gpt-oss-120b none | OpenAI | 9.8 | 3.7 | $0.010 | 2/2 | 5.06s |
| #140 | Mimo V2 Omni medium | Xiaomi | 8.3 | 5.9 | $0.683 | 1/2 | 4.99s |
| #137 | Grok 4.20 Beta medium | X AI | 9.8 | 6.0 | $0.750 | 2/2 | 4.89s |