Clasament Rezolvare de puzzle-uri
Vezi ce modele AI se descurcă cel mai bine la Rezolvare de puzzle-uri, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Cost total ↓.
Modele afișate
15
Media pentru Scor Rezolvare de puzzle-uri
6.9
Cel mai bun model
Grok 4.20 Multi Agent Beta 6.7
316/316
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Rezolvare de puzzle-uri | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #309 | Qwen3.5-9B medium | Qwen | 3.0 | 3.8 | $0.062 | 0/3 | 32.3s |
| #234 | Qwen3.6 27B none | Qwen | 5.3 | 5.5 | $0.062 | 1/3 | 5.15s |
| #195 | Qwen3.6 Flash none | Qwen | 3.5 | 6.1 | $0.062 | 0/3 | 1.21s |
| #39 | GLM 5.3 Flash max | Z.ai | 8.7 | 8.7 | $0.059 | 2/3 | 5.61s |
| #163 | Qwen3.5-27B none | Qwen | 6.7 | 6.6 | $0.058 | 1/3 | 1.38s |
| #81 | Qwen3.8 27B medium | Qwen | 8.3 | 7.8 | ~$0.058 | 2/3 | 12.6s |
| #298 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #219 | Inkling Small low | Thinkingmachines | 5.3 | 5.7 | $0.055 | 1/3 | 1.56s |
| #267 | DeepSeek V3.2 none | DeepSeek | 7.6 | 5.0 | $0.054 | 2/3 | 6.91s |
| #246 | Inkling Small none | Thinkingmachines | 3.2 | 5.3 | $0.054 | 0/3 | 665ms |
| #239 | Laguna S 2.1 medium | Poolside | 3.1 | 5.4 | $0.053 | 0/3 | 2.62s |
| #84 | Qwen3.7 Flash high | Qwen | 7.1 | 7.8 | $0.052 | 1/3 | 10.8s |
| #226 | GLM 5V Turbo none | Z.ai | 5.3 | 5.6 | $0.052 | 1/3 | 2.40s |
| #173 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 3/3 | 900ms | |
| #185 | GPT-5.6 Luna low | OpenAI | 7.6 | 6.2 | $0.051 | 2/3 | 3.59s |