Échecs Erreur API
Voyez quels modèles d'IA rencontrent le plus souvent Erreur API, pour repérer les risques de fiabilité avant de choisir. Trier par: Nombre d'échecs ↑.
Catégories
Dans la catégorie Programmation45 Dans la catégorie Combiné26 Dans la catégorie Appel d'outils17 Dans la catégorie Analyse et extraction des données14 Dans la catégorie Astuces anti-IA14 Dans la catégorie Culture générale13 Dans la catégorie Intelligence générale12 Dans la catégorie Résolution d'énigmes12 Dans la catégorie Spécifique au domaine7 Dans la catégorie Suivi des instructions1
68/68
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Erreur API | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #200 | MiMo-V2-Flash none | Xiaomi | 1 | 4.0 | $0.025 | 4/21 | 2.76s |
| #204 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.036 | 3/22 | 82.2s |
| #33 | Kimi K3 max | Moonshot AI | 2 | 8.0 | $3.112 | 16/22 | 122.5s |
| #76 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.6s |
| #90 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.7 | $0.746 | 13/22 | 58.1s |
| #108 | Ring-2.6-1T medium | Inclusionai | 2 | 6.3 | $0.103 | 11/22 | 68.7s |
| #110 | Gemma 4 31B medium | 2 | 6.3 | $0.163 | 14/22 | 75.4s | |
| #115 | Gemma 4 31B none | 2 | 6.2 | $0.035 | 10/22 | 5.34s | |
| #158 | KAT-Coder-Air V2.5 low | Kwaipilot | 2 | 5.4 | $0.041 | 7/22 | 10.1s |
| #161 | Qwen3.6 35B A3B none | Qwen | 2 | 5.3 | $0.061 | 4/22 | 5.52s |
| #167 | Mistral Small 4 medium | Mistral | 2 | 5.1 | $0.096 | 5/22 | 10.8s |
| #178 | Ling-2.6-flash none | Inclusionai | 2 | 4.9 | $0.002 | 6/22 | 10.7s |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #183 | Trinity Large Preview none | Arcee AI | 2 | 4.8 | $0.008 | 4/21 | 2.98s |
| #100 | Hy3 preview medium | Tencent | 3 | 6.5 | $0.018 | 14/21 | 16.3s |