Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↓.
341/341
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #278 | Mistral Small 4 none | Mistral | 10.0 | 5.1 | $0.022 | 1/1 | 1.40s |
| #179 | Gemini 3.5 Flash Lite low | 10.0 | 6.6 | $0.138 | 1/1 | 1.39s | |
| #319 | Granite 4.2 8B none | IBM Granite | 10.0 | 4.3 | $0.037 | 1/1 | 1.39s |
| #269 | Laguna XS 2.1 none | Poolside | 10.0 | 5.3 | $0.008 | 1/1 | 1.36s |
| #293 | Mercury 2.5 Preview none | Inception | 10.0 | 4.9 | $0.018 | 1/1 | 1.29s |
| #284 | Qwen3.5-9B none | Qwen | 10.0 | 5.1 | $0.021 | 1/1 | 1.27s |
| #309 | Mercury 2 none | Inception | 10.0 | 4.7 | $0.030 | 1/1 | 1.27s |
| #329 | Mercury 2.5 none | Inception | 10.0 | 3.9 | $0.016 | 1/1 | 1.23s |
| #82 | Kimi K3 max | Moonshot AI | 3.0 | 7.9 | $3.467 | 0/1 | 0ms |
| #92 | Qwen3.8 27B medium | Qwen | 3.0 | 7.8 | ~$0.058 | 0/1 | 0ms |
| #121 | Kimi K2.7 Code medium | Moonshot AI | 3.0 | 7.4 | $0.655 | 0/1 | 0ms |
| #149 | GLM 5.1 medium | Z.ai | 3.0 | 7.0 | $0.727 | 0/1 | 0ms |
| #159 | Gemini 3.5 Flash none | 3.0 | 6.9 | $1.093 | 0/1 | 0ms | |
| #184 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.6 | $0.750 | 0/1 | 0ms |
| #204 | Gemma 4 31B medium | 3.0 | 6.2 | $0.100 | 0/1 | 0ms |