Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↑.
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #31 | Qwen3.8 Max (0902) high | Qwen | 10.0 | 8.9 | $2.736 | 1/1 | 5.21s |
| #216 | Trinity Large Thinking medium | Arcee AI | 10.0 | 6.1 | $0.756 | 1/1 | 5.26s |
| #193 | Qwen3.6 Max Preview none | Qwen | 10.0 | 6.4 | $0.228 | 1/1 | 5.27s |
| #136 | Claude Opus 4.8 none | Anthropic | 10.0 | 7.3 | $1.166 | 1/1 | 5.35s |
| #108 | Grok 4.7 xhigh | X AI | 10.0 | 7.5 | $2.625 | 1/1 | 5.36s |
| #259 | Mimo V2 Omni none | Xiaomi | 10.0 | 5.5 | $0.021 | 1/1 | 5.40s |
| #78 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.279 | 1/1 | 5.42s |
| #334 | Grok 4.1 Fast none | X AI | 2.8 | 3.8 | $0.008 | 0/1 | 5.51s |
| #119 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 1/1 | 5.51s | |
| #60 | Qwen3.8 27B high | Qwen | 10.0 | 8.4 | ~$0.287 | 1/1 | 5.62s |
| #142 | Muse Glimmer 30B medium | Meta | 10.0 | 7.2 | $0.227 | 1/1 | 5.64s |
| #185 | Gemini 3.1 Flash Lite low | 10.0 | 6.6 | $0.621 | 1/1 | 5.66s | |
| #30 | Grok 4.5 high | X AI | 10.0 | 9.0 | $2.252 | 1/1 | 5.71s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 1/1 | 5.72s |
| #96 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |