Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↑.
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #113 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 1/1 | 8.36s |
| #86 | Qwen3.8 27B low | Qwen | 3.0 | 7.9 | ~$0.071 | 0/1 | 8.42s |
| #20 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 1/1 | 8.44s |
| #21 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 1/1 | 8.76s |
| #4 | GPT-6 Astra high | OpenAI | 10.0 | 9.9 | $3.474 | 1/1 | 8.92s |
| #137 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.247 | 1/1 | 8.92s |
| #146 | Solar Pro 4 high | Upstage | 10.0 | 7.1 | $0.138 | 1/1 | 8.96s |
| #40 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 1/1 | 8.96s |
| #173 | Gemma 4 26B A4B medium | 10.0 | 6.8 | $0.084 | 1/1 | 9.01s | |
| #41 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 1/1 | 9.03s |
| #79 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.799 | 1/1 | 9.25s |
| #64 | GLM 5.3 FlashX max | Z.ai | 10.0 | 8.3 | $0.508 | 1/1 | 9.39s |
| #65 | DeepSeek V4.1 Flash max | DeepSeek | 10.0 | 8.3 | $0.537 | 1/1 | 9.49s |
| #203 | GLM 5.3 FlashX low | Z.ai | 10.0 | 6.3 | $0.090 | 1/1 | 9.52s |
| #183 | Gemini 3.1 Flash Lite Preview low | 10.0 | 6.6 | $0.646 | 1/1 | 9.54s |