AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Catégorie AI BENCHY

Classement Suivi des instructions

Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.

Modèles affichés

15

Moyenne de Score Suivi des instructions

8.0

Meilleur modèle

Mistral Small 4 6.5
Rang Modèle Entreprise Score Suivi des instructions Score Tests corrects Temps de réponse (moy.)
#3 Claude Opus 4.7 medium Anthropic 10.0 9.2 2/2 1.57s
#21 Gemini 3 Flash Preview none Google 6.4 8.1 1/2 1.58s
#75 GLM 5.1 none Z.ai 8.3 5.6 1/2 1.58s
#69 Kimi K2.6 none Moonshot AI 6.5 5.8 1/2 1.64s
#49 Qwen3.5 Plus 2026-02-15 none Qwen 10.0 6.8 2/2 1.67s
#38 GPT-5.4 Nano medium OpenAI 9.8 7.6 2/2 1.88s
#17 Gemini 3.1 Flash Lite Preview medium Google 10.0 8.2 2/2 1.91s
#42 Claude Sonnet 4.6 none Anthropic 6.5 7.4 1/2 1.96s
#58 GLM 5V Turbo none Z.ai 6.5 6.2 1/2 1.97s
#77 GLM 5 Turbo none Z.ai 6.5 5.5 1/2 2.13s
#37 Claude Opus 4.6 medium Anthropic 10.0 7.6 2/2 2.43s
#44 GPT-5.4 Mini medium OpenAI 7.4 7.3 1/2 2.50s
#65 MiMo-V2-Pro none Xiaomi 6.5 6.0 1/2 2.51s
#26 Claude Sonnet 4.6 medium Anthropic 10.0 8.0 2/2 2.61s
#15 Gemini 2.5 Flash medium Google 9.8 8.2 2/2 2.62s

Meilleurs modèles par Score Suivi des instructions

Score Suivi des instructions vs coût total

Meilleurs modèles par Temps de réponse (moy.)