AI BENCHY
Your ad here

Категория AI BENCHY

Рейтинг Следование инструкциям

Посмотрите, какие AI-модели лучше всего справляются с Следование инструкциям, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↓.

Показано моделей

8

Среднее значение Оценка Следование инструкциям

8.0

Лучшая модель

Kimi K2.5 10.0
Ранг Модель Компания Оценка Следование инструкциям Оценка Тестов верно Время ответа (среднее)
#86 GPT-5.4 Mini none OpenAI 6.3 5.1 1/2 728ms
#79 Grok 4.20 Beta none X AI 4.8 5.3 0/2 687ms
#62 Gemini 2.5 Flash none Google 8.0 6.2 1/2 672ms
#70 Qwen3.5-122B-A10B none Qwen 4.5 5.7 0/2 585ms
#91 Mercury 2 none Inception 6.5 4.8 1/2 551ms
#90 Qwen3.5-9B none Qwen 6.5 4.8 1/2 514ms
#82 Grok 4.20 none X AI 4.8 5.2 0/2 455ms
#83 Mistral Small 4 none Mistral 6.5 5.2 1/2 380ms

Лучшие модели по Оценка Следование инструкциям

Оценка Следование инструкциям vs общая стоимость

Лучшие модели по Время ответа (среднее)