Ranking de Resolução de quebra-cabeças
Veja quais modelos de IA vão melhor em Resolução de quebra-cabeças, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↑.
Modelos exibidos
15
Média de Pontuação de Resolução de quebra-cabeças
6.7
Melhor modelo
Step 3.5 Flash 0.0
216/216
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Resolução de quebra-cabeças | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #69 | Gemini 3.1 Flash Lite medium | 7.6 | 7.3 | $0.117 | 2/3 | 1.95s | |
| #189 | Trinity Large Preview none | Arcee AI | 3.6 | 4.8 | $0.008 | 0/3 | 1.97s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.7 | 6.1 | $0.122 | 1/3 | 1.97s |
| #174 | MiMo-V2.5 none | Xiaomi | 5.4 | 5.1 | $0.025 | 1/3 | 2.13s |
| #126 | Gemini 3.1 Flash Lite minimal | 6.0 | 6.1 | $0.047 | 1/3 | 2.15s | |
| #173 | Mistral Small 4 medium | Mistral | 3.4 | 5.1 | $0.096 | 0/3 | 2.17s |
| #14 | Gemini 3.5 Flash low | 10.0 | 8.9 | $0.433 | 3/3 | 2.35s | |
| #183 | Nemotron 3 Super none | NVIDIA | 5.5 | 4.9 | $0.008 | 1/3 | 2.36s |
| #140 | Mimo V2 Omni medium | Xiaomi | 5.9 | 5.9 | $0.683 | 1/3 | 2.38s |
| #12 | Gemini 3.5 Flash medium | 7.7 | 9.1 | $0.642 | 2/3 | 2.38s | |
| #151 | GLM 5V Turbo none | Z.ai | 5.3 | 5.6 | $0.052 | 1/3 | 2.40s |
| #18 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.477 | 3/3 | 2.43s |
| #99 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 3/3 | 2.46s |
| #150 | KAT-Coder-Air V2.5 high | Kwaipilot | 3.5 | 5.6 | $0.077 | 0/3 | 2.47s |
| #1 | Gemini 3.6 Flash medium | 10.0 | 9.9 | $0.831 | 3/3 | 2.53s |