AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Échecs par catégorie AI BENCHY

Résolution d'énigmes : Mauvaise réponse

Résolution d'énigmes
Mauvaise réponse

Voyez quels modèles d'IA ont le plus de chances de rencontrer Mauvaise réponse sur Résolution d'énigmes, pour repérer plus vite les points faibles.

Modèles affichés

5

Échecs totaux

85

Modèle le plus touché

Kimi K2.5 3
Rang Modèle Entreprise Nombre de Mauvaise réponse Score de catégorie Tests corrects Temps de réponse (moy.)
#86 GPT-5.4 Mini none OpenAI 1 5.4 1/3 860ms
#88 Nemotron 3 Super none NVIDIA 1 5.7 1/3 7.50s
#90 Qwen3.5-9B none Qwen 1 3.2 0/3 683ms
#92 Qwen3 Coder Next medium Qwen 1 3.1 0/3 2.30s
#98 LFM2-24B-A2B none Liquid 1 4.4 0/3 1.69s

Meilleurs modèles par Nombre de Mauvaise réponse

Nombre de Mauvaise réponse vs Score

Meilleurs modèles par Temps de réponse (moy.)

Meilleurs modèles par Coût gaspillé estimé