Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Общая стоимость ↑.
Показано моделей
15
Среднее значение Оценка Вызов инструментов
8.9
Лучшая модель
Dots 3 Note Preview 10.0
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #248 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #96 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |
| #263 | Laguna S 2.1 medium | Poolside | 10.0 | 5.4 | $0.053 | 1/1 | 2.24s |
| #270 | Inkling Small none | Thinkingmachines | 3.0 | 5.3 | $0.054 | 0/1 | 2.31s |
| #292 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 1/1 | 11.8s |
| #239 | Nemotron 3 Super medium | NVIDIA | 10.0 | 5.7 | $0.054 | 1/1 | 39.7s |
| #241 | Inkling Small low | Thinkingmachines | 3.0 | 5.7 | $0.055 | 0/1 | 2.21s |
| #196 | GLM 5.3 FlashX medium | Z.ai | 10.0 | 6.4 | $0.056 | 1/1 | 10.3s |
| #132 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.057 | 1/1 | 15.6s |
| #323 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |
| #93 | Qwen3.8 27B medium | Qwen | 3.0 | 7.8 | ~$0.058 | 0/1 | 0ms |
| #182 | Qwen3.5-27B none | Qwen | 10.0 | 6.6 | $0.058 | 1/1 | 3.54s |
| #275 | Qwen3.6 35B A3B none | Qwen | 3.0 | 5.3 | $0.061 | 0/1 | 0ms |
| #217 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 2.49s |
| #256 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.062 | 1/1 | 6.74s |