Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Résolution d'énigmes
6.7
Meilleur modèle
Gemini 3 Flash Preview 10.0
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #33 | Kimi K3 max | Moonshot AI | 10.0 | 8.0 | $3.112 | 3/3 | 7.36s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 3/3 | 16.4s |
| #37 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 3/3 | 6.34s |
| #40 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.057 | 3/3 | 5.31s |
| #41 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.077 | 3/3 | 3.01s |
| #42 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 3/3 | 11.3s |
| #54 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 3/3 | 2.99s |
| #55 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.519 | 3/3 | 4.46s |
| #57 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.437 | 3/3 | 32.5s |
| #59 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 3/3 | 1.13s |
| #61 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 3/3 | 5.77s | |
| #72 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.046 | 3/3 | 17.9s |
| #79 | Gemini 3.5 Flash none | 10.0 | 7.0 | $1.079 | 3/3 | 3.13s | |
| #82 | DeepSeek V4 Pro none | DeepSeek | 10.0 | 6.9 | $0.096 | 3/3 | 3.61s |
| #88 | Gemini 3.5 Flash minimal | 10.0 | 6.8 | $0.300 | 3/3 | 1.45s |