Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.
316/316
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #103 | Grok Build 0.1 medium | X AI | 7.7 | 7.5 | $1.130 | 2/3 | 18.3s |
| #216 | North Mini Code medium | Cohere | 3.3 | 5.7 | $0.000 | 0/3 | 19.7s |
| #178 | MiMo-V2.5 medium | Xiaomi | 8.2 | 6.4 | $0.104 | 2/3 | 20.3s |
| #204 | GPT-5 Nano medium | OpenAI | 5.3 | 6.0 | $0.118 | 1/3 | 20.6s |
| #180 | Ring-2.6-1T medium | Inclusionai | 5.9 | 6.4 | $0.102 | 1/3 | 20.7s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 9.9 | 8.4 | $1.951 | 3/3 | 21.0s |
| #189 | gpt-oss-120b medium | OpenAI | 5.3 | 6.1 | $0.020 | 1/3 | 21.7s |
| #131 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 22.5s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 23.5s |
| #238 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.039 | 0/3 | 23.7s |
| #273 | Hy4 preview none | Tencent | 4.6 | 4.8 | $0.041 | 0/3 | 24.1s |
| #45 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 3/3 | 24.3s |
| #259 | Qwen3 Coder Next none | Qwen | 3.0 | 5.1 | $0.026 | 0/3 | 24.3s |
| #263 | North Mini Code none | Cohere | 3.5 | 5.1 | $0.000 | 0/3 | 24.4s |
| #264 | MiniMax M2.7 medium | Minimax | 5.9 | 5.0 | $0.208 | 1/3 | 24.9s |