Échecs Aucune réponse
Voyez quels modèles d'IA rencontrent le plus souvent Aucune réponse, pour repérer les risques de fiabilité avant de choisir. Trier par: Score ↑.
Modèles affichés
15
Échecs totaux
181
Modèle le plus touché
Nemotron 3 Nano Omni 30b A3b Reasoning 1Catégories
Dans la catégorie Combiné43 Dans la catégorie Programmation39 Dans la catégorie Spécifique au domaine35 Dans la catégorie Culture générale27 Dans la catégorie Astuces anti-IA13 Dans la catégorie Résolution d'énigmes11 Dans la catégorie Analyse et extraction des données9 Dans la catégorie Appel d'outils2 Dans la catégorie Suivi des instructions2
119/119
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Aucune réponse | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #271 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #268 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #267 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #263 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.68s |
| #262 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.026 | 5/22 | 8.63s |
| #261 | Granite 4.2 8B low | IBM Granite | 1 | 5.1 | $0.012 | 7/22 | 54.4s |
| #260 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #257 | Granite 4.2 8B medium | IBM Granite | 1 | 5.2 | $0.009 | 7/22 | 46.0s |
| #254 | Qwen3.6 35B A3B none | Qwen | 1 | 5.3 | $0.051 | 4/22 | 5.57s |
| #251 | Seed-2.0-Code none | Bytedance Seed | 1 | 5.3 | $0.151 | 6/22 | 14.7s |
| #248 | Laguna S 2.1 high | Poolside | 2 | 5.4 | $0.114 | 4/22 | 111.6s |
| #246 | Kimi K2.5 none | Moonshot AI | 1 | 5.4 | $0.101 | 5/22 | 18.0s |
| #245 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.4 | $0.068 | 5/22 | 4.24s |
| #242 | Laguna S 2.1 medium | Poolside | 2 | 5.4 | $0.053 | 4/22 | 58.4s |
| #236 | Hy4 preview low | Tencent | 1 | 5.6 | $1.745 | 3/22 | 214.3s |