Classement des échecs pour Erreur API

Voyez quels modèles d'IA rencontrent le plus souvent Erreur API, pour repérer les risques de fiabilité avant de choisir. Trier par: Temps de réponse (moy.) ↓.

Modèles affichés

Échecs totaux

161

Modèle le plus touché

Step 3.5 Flash 1

Catégories

Dans la catégorie Programmation45 Dans la catégorie Combiné26 Dans la catégorie Appel d'outils17 Dans la catégorie Analyse et extraction des données14 Dans la catégorie Astuces anti-IA14 Dans la catégorie Culture générale13 Dans la catégorie Intelligence générale12 Dans la catégorie Résolution d'énigmes12 Dans la catégorie Spécifique au domaine7 Dans la catégorie Suivi des instructions1

68/68

Rang	Modèle	Entreprise	Nombre de Erreur API	Score	Coût total	Tests corrects	Temps de réponse (moy.)
#109	Mimo V2 PRO medium	Xiaomi	1	6.3	$0.333	12/21	22.2s
Tests totaux 21 Tests incorrects 9 Coût total $0.333 Temps de réponse (moy.) 22.2s
#206	gpt-oss-120b none	OpenAI	3	3.7	$0.010	6/19	21.6s
Tests totaux 19 Tests incorrects 13 Coût total $0.010 Temps de réponse (moy.) 21.6s
#113	MiMo-V2-Flash medium	Xiaomi	1	6.3	$0.043	12/21	20.1s
Tests totaux 21 Tests incorrects 9 Coût total $0.043 Temps de réponse (moy.) 20.1s
#62	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
Tests totaux 22 Tests incorrects 11 Coût total $0.387 Temps de réponse (moy.) 19.5s
#173	DeepSeek V3.2 none	DeepSeek	4	5.0	$0.054	6/22	18.3s
Tests totaux 22 Tests incorrects 16 Coût total $0.054 Temps de réponse (moy.) 18.3s
#207	Nemotron 3 Nano Omni 30b A3b Reasoning medium	NVIDIA	6	3.4	$0.000	4/19	17.1s
Tests totaux 19 Tests incorrects 15 Coût total $0.000 Temps de réponse (moy.) 17.1s
#100	Hy3 preview medium	Tencent	3	6.5	$0.018	14/21	16.3s
Tests totaux 21 Tests incorrects 7 Coût total $0.018 Temps de réponse (moy.) 16.3s
#32	Inkling medium	Thinkingmachines	1	8.0	$0.391	15/22	16.2s
Tests totaux 22 Tests incorrects 7 Coût total $0.391 Temps de réponse (moy.) 16.2s
#144	KAT-Coder-Air V2.5 high	Kwaipilot	3	5.6	$0.077	7/22	15.9s
Tests totaux 22 Tests incorrects 15 Coût total $0.077 Temps de réponse (moy.) 15.9s
#175	Qwen3.6 Plus Preview medium	Qwen	8	4.9	$0.000	9/19	15.2s
Tests totaux 19 Tests incorrects 10 Coût total $0.000 Temps de réponse (moy.) 15.2s
#186	Laguna M.1 medium	Poolside	4	4.7	$0.033	9/19	14.7s
Tests totaux 19 Tests incorrects 10 Coût total $0.033 Temps de réponse (moy.) 14.7s
#199	Hy3 preview none	Tencent	4	4.0	$0.003	4/21	12.9s
Tests totaux 21 Tests incorrects 17 Coût total $0.003 Temps de réponse (moy.) 12.9s
#182	KAT-Coder-Air V2.5 none	Kwaipilot	1	4.8	$0.067	5/22	12.2s
Tests totaux 22 Tests incorrects 17 Coût total $0.067 Temps de réponse (moy.) 12.2s
#146	Owl Alpha medium	Openrouter	1	5.6	$0.000	8/21	11.9s
Tests totaux 21 Tests incorrects 13 Coût total $0.000 Temps de réponse (moy.) 11.9s
#167	Mistral Small 4 medium	Mistral	2	5.1	$0.096	5/22	10.8s
Tests totaux 22 Tests incorrects 17 Coût total $0.096 Temps de réponse (moy.) 10.8s

←

1 2 3 4 5

→

Échecs Erreur API

Filtrer les modèles

Meilleurs modèles par Nombre de Erreur API

Nombre de Erreur API vs Score

Meilleurs modèles par Temps de réponse (moy.)