Classement Résolution d'énigmes
Voyez quels modèles d'IA réussissent le mieux sur Résolution d'énigmes, lesquels restent fiables et où les écarts sont les plus marqués.
316/316
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Résolution d'énigmes | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #205 | Qwen3.5-Flash none | Qwen | 3.1 | 6.0 | $0.073 | 0/3 | 10.9s |
| #239 | Laguna S 2.1 medium | Poolside | 3.1 | 5.4 | $0.053 | 0/3 | 2.62s |
| #249 | Ling-2.6-1T none | Inclusionai | 3.1 | 5.3 | $0.016 | 0/3 | 5.36s |
| #286 | Mercury 2 none | Inception | 3.1 | 4.7 | $0.030 | 0/3 | 535ms |
| #290 | Laguna S 2.1 none | Poolside | 3.1 | 4.5 | $0.022 | 0/3 | 828ms |
| #300 | Hy3 preview none | Tencent | 3.1 | 4.0 | $0.007 | 0/3 | 4.56s |
| #304 | Nemotron 3.5 Lightning none | NVIDIA | 3.1 | 4.0 | $0.007 | 0/3 | 750ms |
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 3.1 | 5.4 | $0.046 | 0/3 | 1.57s |
| #238 | DeepSeek V4 Flash 0423 none | DeepSeek | 3.1 | 5.4 | $0.039 | 0/3 | 23.7s |
| #254 | Granite 4.2 8B medium | IBM Granite | 3.1 | 5.2 | $0.009 | 0/3 | 76.0s |
| #217 | Nemotron 3 Super medium | NVIDIA | 3.0 | 5.7 | $0.050 | 0/3 | 3.15s |
| #243 | Kimi K2.5 none | Moonshot AI | 3.0 | 5.4 | $0.101 | 0/3 | 4.04s |
| #247 | Laguna XS 2.1 none | Poolside | 3.0 | 5.3 | $0.008 | 0/3 | 1.01s |
| #258 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/3 | 90.8s |
| #259 | Qwen3 Coder Next none | Qwen | 3.0 | 5.1 | $0.026 | 0/3 | 24.3s |