Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués.
316/316
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #175 | Dots 3 Note Preview low | Dots Studio | 5.3 | 6.4 | $0.000 | 1/3 | 8.52s |
| #202 | GPT-5.6 Terra none | OpenAI | 5.3 | 6.0 | $0.280 | 1/3 | 1.23s |
| #207 | Step 3.5 Flash medium | Stepfun | 5.3 | 5.9 | $0.132 | 1/3 | 7.22s |
| #220 | Ling-3.0-flash none | Inclusionai | 5.3 | 5.7 | $0.004 | 1/3 | 1.49s |
| #226 | GLM 5V Turbo none | Z.ai | 5.3 | 5.6 | $0.052 | 1/3 | 2.40s |
| #235 | Hy3 preview low | Tencent | 5.3 | 5.5 | $0.042 | 1/3 | 7.51s |
| #241 | GPT-5.6 Luna none | OpenAI | 5.3 | 5.4 | $0.029 | 1/3 | 790ms |
| #269 | Qwen3.6 Plus Preview medium | Qwen | 5.3 | 4.9 | $0.000 | 1/3 | 7.52s |
| #284 | Laguna M.1 medium | Poolside | 5.3 | 4.7 | $0.033 | 1/3 | 10.2s |
| #295 | Elephant Alpha medium | Openrouter | 5.3 | 4.3 | $0.000 | 1/3 | 868ms |
| #298 | Grok 4.20 none | X AI | 5.3 | 4.1 | $0.057 | 1/3 | 473ms |
| #299 | Laguna Xs.2 medium | Poolside | 5.3 | 4.1 | $0.015 | 1/3 | 1.93s |
| #301 | MiMo-V2-Flash none | Xiaomi | 5.3 | 4.0 | $0.025 | 1/3 | 1.86s |
| #311 | Laguna Xs.2 none | Poolside | 5.3 | 3.8 | $0.004 | 1/3 | 650ms |
| #146 | Step 3.7 Flash high | Stepfun | 5.3 | 6.8 | $1.229 | 1/3 | 10.2s |