Classement des échecs pour Aucune réponse

Voyez quels modèles d'IA rencontrent le plus souvent Aucune réponse, pour repérer les risques de fiabilité avant de choisir. Trier par: Temps de réponse (moy.) ↓.

Modèles affichés

Échecs totaux

Modèle le plus touché

Step 3.5 Flash 1

Catégories

Dans la catégorie Combiné29 Dans la catégorie Programmation18 Dans la catégorie Culture générale13 Dans la catégorie Analyse et extraction des données8 Dans la catégorie Spécifique au domaine8 Dans la catégorie Astuces anti-IA4 Dans la catégorie Résolution d'énigmes3 Dans la catégorie Appel d'outils2 Dans la catégorie Suivi des instructions2

67/67

Rang	Modèle	Entreprise	Nombre de Aucune réponse	Score	Coût total	Tests corrects	Temps de réponse (moy.)
#130	Step 3.5 Flash medium	Stepfun	1	6.0	$0.108	11/21	174.2s
Tests totaux 21 Tests incorrects 10 Coût total $0.108 Temps de réponse (moy.) 174.2s
#97	LongCat 2.0 high	Meituan	2	6.6	$0.469	9/22	148.7s
Tests totaux 22 Tests incorrects 13 Coût total $0.469 Temps de réponse (moy.) 148.7s
#194	GLM 4.7 Flash medium	Z.ai	3	4.3	$0.166	4/22	142.6s
Tests totaux 22 Tests incorrects 18 Coût total $0.166 Temps de réponse (moy.) 142.6s
#60	LongCat 2.0 medium	Meituan	1	7.4	$0.478	12/22	136.6s
Tests totaux 22 Tests incorrects 10 Coût total $0.478 Temps de réponse (moy.) 136.6s
#33	Kimi K3 max	Moonshot AI	1	8.0	$3.112	16/22	122.5s
Tests totaux 22 Tests incorrects 6 Coût total $3.112 Temps de réponse (moy.) 122.5s
#119	Qwen3.5-35B-A3B medium	Qwen	2	6.2	$0.837	11/22	112.5s
Tests totaux 22 Tests incorrects 11 Coût total $0.837 Temps de réponse (moy.) 112.5s
#68	Kimi K2.6 medium	Moonshot AI	1	7.2	$1.036	12/22	110.0s
Tests totaux 22 Tests incorrects 10 Coût total $1.036 Temps de réponse (moy.) 110.0s
#99	Qwen3.6 27B medium	Qwen	3	6.5	$0.779	10/22	106.3s
Tests totaux 22 Tests incorrects 12 Coût total $0.779 Temps de réponse (moy.) 106.3s
#95	Gemma 4 26B A4B medium	Google	2	6.6	$0.089	14/22	103.8s
Tests totaux 22 Tests incorrects 8 Coût total $0.089 Temps de réponse (moy.) 103.8s
#91	LongCat 2.0 low	Meituan	1	6.7	$0.391	10/22	100.3s
Tests totaux 22 Tests incorrects 12 Coût total $0.391 Temps de réponse (moy.) 100.3s
#77	Kimi K2.5 medium	Moonshot AI	2	7.0	$0.600	10/22	99.0s
Tests totaux 22 Tests incorrects 12 Coût total $0.600 Temps de réponse (moy.) 99.0s
#80	Seed-2.0-Mini medium	Bytedance Seed	1	7.0	$0.101	11/22	92.5s
Tests totaux 22 Tests incorrects 11 Coût total $0.101 Temps de réponse (moy.) 92.5s
#204	Qwen3.5-9B medium	Qwen	2	3.8	$0.036	3/22	82.2s
Tests totaux 22 Tests incorrects 19 Coût total $0.036 Temps de réponse (moy.) 82.2s
#46	DeepSeek V4 Pro high	DeepSeek	1	7.7	$0.200	10/22	79.1s
Tests totaux 22 Tests incorrects 12 Coût total $0.200 Temps de réponse (moy.) 79.1s
#12	Grok 4.5 high	X AI	2	8.9	$1.707	17/22	76.5s
Tests totaux 22 Tests incorrects 5 Coût total $1.707 Temps de réponse (moy.) 76.5s

1 2 3 4 5

→

Échecs Aucune réponse

Filtrer les modèles

Meilleurs modèles par Nombre de Aucune réponse

Nombre de Aucune réponse vs Score

Meilleurs modèles par Temps de réponse (moy.)