Clasament Rezolvare de puzzle-uri
Vezi ce modele AI se descurcă cel mai bine la Rezolvare de puzzle-uri, care rămân fiabile și unde apar cele mai mari diferențe. Sortează după: Teste corecte ↑.
316/316
Filtrează modelele
Niciun model nu corespunde căutării și filtrelor curente.
| Rang | Model | Companie | Scor Rezolvare de puzzle-uri | Scor | Cost total | Teste corecte | Timp de răspuns (mediu) |
|---|---|---|---|---|---|---|---|
| #81 | Qwen3.8 27B medium | Qwen | 8.3 | 7.8 | ~$0.058 | 2/3 | 12.6s |
| #82 | Seed-2.0-Lite medium | Bytedance Seed | 9.0 | 7.8 | $0.236 | 2/3 | 10.2s |
| #87 | Claude Opus 4.6 medium | Anthropic | 7.7 | 7.7 | $2.961 | 2/3 | 4.71s |
| #89 | DeepSeek V4 Flash 0423 high | DeepSeek | 8.2 | 7.6 | $0.042 | 2/3 | 26.1s |
| #90 | GLM 5 Turbo medium | Z.ai | 8.7 | 7.6 | $0.323 | 2/3 | 5.23s |
| #91 | GPT-5.6 Luna high | OpenAI | 7.6 | 7.6 | $0.179 | 2/3 | 14.6s |
| #92 | Solar Pro 4 xhigh | Upstage | 8.9 | 7.6 | $0.050 | 2/3 | 58.0s |
| #94 | Claude Opus 5 none | Anthropic | 7.7 | 7.5 | $1.550 | 2/3 | 3.66s |
| #97 | MiniMax M3 medium | Minimax | 7.9 | 7.5 | $0.300 | 2/3 | 49.9s |
| #100 | Qwen3.5-27B medium | Qwen | 8.2 | 7.5 | $0.982 | 2/3 | 59.6s |
| #102 | GPT-5.4 Mini medium | OpenAI | 7.8 | 7.5 | $0.786 | 2/3 | 4.37s |
| #103 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #105 | Gemini 3.1 Flash Lite Preview medium | 7.7 | 7.4 | $0.117 | 2/3 | 5.30s | |
| #108 | GPT-5.6 Luna medium | OpenAI | 7.8 | 7.4 | $0.072 | 2/3 | 4.04s |
| #113 | Claude Sonnet 4.6 none | Anthropic | 7.7 | 7.3 | $0.661 | 2/3 | 2.53s |