Рейтинг Вызов инструментов
Посмотрите, какие AI-модели лучше всего справляются с Вызов инструментов, какие остаются надежными и где заметнее всего разница. Сортировать по: Время ответа (среднее) ↑.
343/343
Фильтровать модели
Нет моделей, соответствующих текущему поиску и фильтрам.
| Ранг | Модель | Компания | Оценка Вызов инструментов | Оценка | Общая стоимость | Тестов верно | Время ответа (среднее) |
|---|---|---|---|---|---|---|---|
| #332 | Ling 3.0 Tiny high | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.76s |
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 5.78s | |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 1/1 | 5.83s | |
| #58 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.945 | 1/1 | 5.83s |
| #88 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 1/1 | 5.87s |
| #294 | Qwen3.6 Plus Preview medium | Qwen | 10.0 | 4.9 | $0.000 | 1/1 | 5.87s |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 1/1 | 5.93s |
| #175 | KAT-Coder-Pro V2.5 none | Kwaipilot | 10.0 | 6.7 | $0.487 | 1/1 | 5.93s |
| #333 | Ling 3.0 Tiny low | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.94s |
| #302 | Trinity Large Thinking high | Arcee AI | 10.0 | 4.8 | $0.592 | 1/1 | 5.96s |
| #66 | Muse Spark 1.1 low | Meta | 9.8 | 8.3 | $0.673 | 1/1 | 5.98s |
| #123 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 1/1 | 6.02s |
| #322 | Hunter Alpha none | OpenRouter | 10.0 | 4.2 | $0.000 | 1/1 | 6.02s |
| #68 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.644 | 1/1 | 6.20s | |
| #13 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.4 | $0.508 | 1/1 | 6.30s |