Ranking de Resolução de quebra-cabeças
Veja quais modelos de IA vão melhor em Resolução de quebra-cabeças, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Métrica ↑.
Modelos exibidos
6
Média de Pontuação de Resolução de quebra-cabeças
6.7
Melhor modelo
Step 3.5 Flash 0.0
216/216
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Resolução de quebra-cabeças | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #110 | Gemini 3.1 Flash Lite Preview low | 10.0 | 6.5 | $0.646 | 3/3 | 1.69s | |
| #111 | Gemini 3.1 Flash Lite low | 10.0 | 6.5 | $0.621 | 3/3 | 1.40s | |
| #112 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 3/3 | 900ms | |
| #137 | Grok 4.20 Beta medium | X AI | 10.0 | 6.0 | $0.750 | 3/3 | 3.52s |
| #139 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 3/3 | 3.88s | |
| #163 | Mimo V2 Omni none | Xiaomi | 10.0 | 5.5 | $0.021 | 3/3 | 1.16s |