Clasament Rezolvare de puzzle-uri
Vezi ce modele AI se descurcă cel mai bine la Rezolvare de puzzle-uri, care rămân fiabile și unde apar cele mai mari diferențe.
Modele afișate
15
Media pentru Scor Rezolvare de puzzle-uri
6.9
Cel mai bun model
Gemini 3.6 Flash 10.0
316/316
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Rezolvare de puzzle-uri | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #156 | KAT-Coder-Pro V2.5 none | Kwaipilot | 8.2 | 6.7 | $0.487 | 2/3 | 3.03s |
| #178 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |
| #188 | Qwen3.5-35B-A3B medium | Qwen | 8.2 | 6.1 | $0.675 | 2/3 | 33.1s |
| #192 | Qwen3.5-Flash medium | Qwen | 8.2 | 6.1 | $0.142 | 2/3 | 27.6s |
| #265 | Mercury 2.5 Preview low | Inception | 8.2 | 5.0 | $0.011 | 2/3 | 710ms |
| #41 | Muse Spark 1.2 high | Meta | 8.2 | 8.7 | $1.771 | 2/3 | 10.1s |
| #67 | DeepSeek V4 Flash 0731 high | DeepSeek | 8.2 | 8.0 | $0.084 | 2/3 | 9.36s |
| #100 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |
| #119 | DeepSeek V4 Flash 0731 medium | DeepSeek | 8.2 | 7.3 | $0.066 | 2/3 | 65.1s |
| #66 | DeepSeek V4 Flash 0731 low | DeepSeek | 8.0 | 8.0 | $0.044 | 2/3 | 9.08s |
| #167 | Qwen3.6 35B A3B medium | Qwen | 8.0 | 6.6 | $0.672 | 2/3 | 5.95s |
| #43 | Muse Spark 1.1 medium | Meta | 7.9 | 8.6 | $1.420 | 2/3 | 42.5s |
| #97 | MiniMax M3 medium | Minimax | 7.9 | 7.5 | $0.300 | 2/3 | 49.9s |
| #63 | Muse Glimmer 30B xhigh | Meta | 7.8 | 8.1 | $0.471 | 2/3 | 199.7s |
| #143 | Seed-2.0-Code high | Bytedance Seed | 7.8 | 6.9 | $1.273 | 2/3 | 15.9s |