Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Общая стоимость ↓.
Показано моделей
15
Среднее значение Оценка Вызов инструментов
8.9
Лучшая модель
Grok 4.20 Multi Agent Beta 3.0
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #225 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 12.0s | |
| #80 | Inkling medium | Thinkingmachines | 3.0 | 8.0 | $0.383 | 0/1 | 4.48s |
| #8 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.357 | 1/1 | 7.56s |
| #201 | Mimo V2 PRO medium | Xiaomi | 10.0 | 6.3 | $0.333 | 1/1 | 8.19s |
| #314 | MiniMax M2.5 medium | Minimax | 10.0 | 4.6 | $0.327 | 1/1 | 15.4s |
| #103 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #140 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.323 | 1/1 | 14.7s |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 1/1 | 5.83s | |
| #112 | MiniMax M3 medium | Minimax | 10.0 | 7.5 | $0.300 | 1/1 | 11.9s |
| #177 | Gemini 3.5 Flash minimal | 10.0 | 6.7 | $0.300 | 1/1 | 2.79s | |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.5 | $0.287 | 1/1 | 15.3s |
| #60 | Qwen3.8 27B high | Qwen | 10.0 | 8.4 | ~$0.287 | 1/1 | 5.62s |
| #224 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.280 | 1/1 | 3.10s |
| #78 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.279 | 1/1 | 5.42s |
| #87 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 1/1 | 15.0s |