Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Résolution d'énigmes
6.7
Meilleur modèle
Gemini 3 Flash Preview 10.0
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #146 | Owl Alpha medium | Openrouter | 5.3 | 5.6 | $0.000 | 1/3 | 3.40s |
| #152 | Qwen3.6 27B none | Qwen | 5.3 | 5.5 | $0.087 | 1/3 | 5.15s |
| #190 | MiniMax M2.5 medium | Minimax | 5.3 | 4.6 | $0.340 | 1/3 | 11.2s |
| #193 | Elephant Alpha none | Openrouter | 4.2 | 4.3 | $0.000 | 0/3 | 807ms |
| #53 | GPT-5.4 Nano medium | OpenAI | 4.1 | 7.5 | $0.138 | 0/3 | 3.79s |
| #111 | LongCat 2.0 none | Meituan | 4.0 | 6.3 | $0.044 | 0/3 | 2.74s |
| #142 | Qwen3.5-122B-A10B none | Qwen | 3.8 | 5.7 | $0.247 | 0/3 | 1.00s |
| #210 | LFM2-24B-A2B none | Liquid | 3.8 | 2.2 | $0.001 | 0/3 | 1.78s |
| #127 | Qwen3.5-35B-A3B none | Qwen | 3.7 | 6.1 | $0.106 | 0/3 | 1.35s |
| #149 | KAT-Coder-Air V2.5 medium | Kwaipilot | 3.6 | 5.6 | $0.048 | 0/3 | 1.87s |
| #188 | Cobuddy medium | Baidu | 3.6 | 4.7 | $0.000 | 0/3 | 12.8s |
| #183 | Trinity Large Preview none | Arcee AI | 3.6 | 4.8 | $0.008 | 0/3 | 1.97s |
| #144 | KAT-Coder-Air V2.5 high | Kwaipilot | 3.5 | 5.6 | $0.077 | 0/3 | 2.47s |
| #124 | Qwen3.6 Flash none | Qwen | 3.5 | 6.1 | $0.062 | 0/3 | 1.21s |
| #171 | North Mini Code none | Cohere | 3.5 | 5.1 | $0.000 | 0/3 | 24.4s |