Сбои по категориям AI BENCHY
Комбинированный: Недопустимый вызов инструмента
Комбинированный
Недопустимый вызов инструмента
Посмотрите, какие AI-модели чаще всего сталкиваются с Недопустимый вызов инструмента в Комбинированный, чтобы быстрее находить слабые места.
Причины сбоев
Категории
| Ранг | Модель | Компания | Количество Недопустимый вызов инструмента | Оценка категории | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|
| #145 | Laguna M.1 none | Poolside | 1 | 3.0 | 0/1 | 4.32s |
| #154 | Qwen3.5-9B none | Qwen | 1 | 3.0 | 0/1 | 5.91s |
| #158 | GLM 4.7 Flash medium | Z.ai | 1 | 2.8 | 0/1 | 65.6s |
| #163 | Granite 4.1 8B none | IBM Granite | 1 | 3.0 | 0/1 | 1.88s |