Échecs Erreur API
Voyez quels modèles d'IA rencontrent le plus souvent Erreur API, pour repérer les risques de fiabilité avant de choisir. Trier par: Tests corrects ↓.
Catégories
Dans la catégorie Programmation45 Dans la catégorie Combiné26 Dans la catégorie Appel d'outils17 Dans la catégorie Analyse et extraction des données14 Dans la catégorie Astuces anti-IA14 Dans la catégorie Culture générale13 Dans la catégorie Intelligence générale12 Dans la catégorie Résolution d'énigmes12 Dans la catégorie Spécifique au domaine7 Dans la catégorie Suivi des instructions1
68/68
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Erreur API | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #91 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.391 | 10/22 | 100.3s |
| #115 | Gemma 4 31B none | 2 | 6.2 | $0.035 | 10/22 | 5.34s | |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #184 | Hunter Alpha medium | OpenRouter | 1 | 4.7 | $0.000 | 8/18 | 10.3s |
| #137 | North Mini Code medium | Cohere | 1 | 5.9 | $0.000 | 9/22 | 137.1s |
| #179 | Ring-2.6-1T none | Inclusionai | 6 | 4.8 | $0.026 | 9/22 | 55.1s |
| #146 | Owl Alpha medium | Openrouter | 1 | 5.6 | $0.000 | 8/21 | 11.9s |
| #157 | Mimo V2 Omni none | Xiaomi | 1 | 5.5 | $0.021 | 8/21 | 2.44s |
| #202 | Grok Build 0.1 none | X AI | 3 | 4.0 | $0.547 | 7/19 | 28.7s |
| #129 | Nemotron 3 Ultra none | NVIDIA | 1 | 6.1 | $0.095 | 8/22 | 3.87s |
| #140 | Nemotron 3 Super medium | NVIDIA | 4 | 5.7 | $0.050 | 8/22 | 52.0s |
| #149 | KAT-Coder-Air V2.5 medium | Kwaipilot | 1 | 5.6 | $0.048 | 8/22 | 8.42s |
| #147 | Mimo V2 PRO none | Xiaomi | 1 | 5.6 | $0.045 | 7/21 | 2.27s |
| #188 | Cobuddy medium | Baidu | 1 | 4.7 | $0.000 | 7/21 | 39.9s |