Clasament Rezolvare de puzzle-uri
Vezi ce modele AI se descurcă cel mai bine la Rezolvare de puzzle-uri, care rămân fiabile și unde apar cele mai mari diferențe.
Modele afișate
15
Media pentru Scor Rezolvare de puzzle-uri
6.7
Cel mai bun model
Gemini 3 Flash Preview 10.0
210/210
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Rezolvare de puzzle-uri | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #3 | GPT-5.6 Sol low | OpenAI | 8.2 | 9.5 | $0.971 | 2/3 | 3.44s |
| #4 | GPT-5.6 Sol medium | OpenAI | 8.2 | 9.4 | $1.316 | 2/3 | 2.98s |
| #18 | GPT-5.4 medium | OpenAI | 8.2 | 8.5 | $1.533 | 2/3 | 9.14s |
| #38 | GLM 5.2 medium | Z.ai | 8.2 | 7.8 | $0.222 | 2/3 | 13.1s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 8.2 | 7.7 | $0.042 | 2/3 | 26.1s |
| #69 | KAT-Coder-Pro V2.5 high | Kwaipilot | 8.2 | 7.2 | $0.482 | 2/3 | 3.38s |
| #70 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 8.2 | 7.2 | $0.317 | 2/3 | 17.7s |
| #74 | GLM 5.1 medium | Z.ai | 8.2 | 7.1 | $0.535 | 2/3 | 31.6s |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 8.2 | 7.0 | $0.101 | 2/3 | 31.8s |
| #85 | Qwen3.6 Flash medium | Qwen | 8.2 | 6.9 | $0.738 | 2/3 | 6.29s |
| #92 | KAT-Coder-Pro V2.5 none | Kwaipilot | 8.2 | 6.7 | $0.476 | 2/3 | 3.03s |
| #101 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.5 | $0.082 | 2/3 | 20.3s |
| #114 | Qwen3.5-Flash medium | Qwen | 8.2 | 6.2 | $0.139 | 2/3 | 27.6s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 8.2 | 6.2 | $0.837 | 2/3 | 33.1s |
| #58 | Qwen3.5-27B medium | Qwen | 8.2 | 7.4 | $1.627 | 2/3 | 59.6s |