Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
316/316
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #209 | Mimo V2 Omni medium | Xiaomi | 5.9 | 5.9 | $0.683 | 1/3 | 2.38s |
| #212 | GPT-5.4 Mini none | OpenAI | 5.4 | 5.9 | $0.095 | 1/3 | 836ms |
| #214 | GPT-5.4 none | OpenAI | 5.6 | 5.8 | $0.397 | 1/3 | 1.44s |
| #215 | Solar Pro 4 none | Upstage | 5.4 | 5.8 | $0.006 | 1/3 | 2.33s |
| #219 | Inkling Small low | Thinkingmachines | 5.3 | 5.7 | $0.055 | 1/3 | 1.56s |
| #220 | Ling-3.0-flash none | Inclusionai | 5.3 | 5.7 | $0.004 | 1/3 | 1.49s |
| #224 | Gemini 3.1 Flash Lite high | 5.7 | 5.6 | $2.044 | 1/3 | 50.8s | |
| #226 | GLM 5V Turbo none | Z.ai | 5.3 | 5.6 | $0.052 | 1/3 | 2.40s |
| #227 | Owl Alpha medium | Openrouter | 5.3 | 5.6 | $0.000 | 1/3 | 3.40s |
| #228 | Gemma 4 26B A4B none | 6.2 | 5.6 | $0.015 | 1/3 | 744ms | |
| #229 | Mimo V2 PRO none | Xiaomi | 6.0 | 5.6 | $0.045 | 1/3 | 1.61s |
| #230 | Owl Alpha none | Openrouter | 5.4 | 5.6 | $0.000 | 1/3 | 4.18s |
| #234 | Qwen3.6 27B none | Qwen | 5.3 | 5.5 | $0.062 | 1/3 | 5.15s |
| #235 | Hy3 preview low | Tencent | 5.3 | 5.5 | $0.042 | 1/3 | 7.51s |
| #236 | Qwen3.8 27B none | Qwen | 6.0 | 5.5 | ~$0.006 | 1/3 | 1.25s |