Peringkat Pemanggilan alat
Lihat model AI mana yang paling baik di Pemanggilan alat, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↓.
338/338
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemanggilan alat | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #317 | Hunter Alpha none | OpenRouter | 10.0 | 4.2 | $0.000 | 1/1 | 6.02s |
| #121 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 1/1 | 6.02s |
| #65 | Muse Spark 1.1 low | Meta | 9.8 | 8.3 | $0.673 | 1/1 | 5.98s |
| #297 | Trinity Large Thinking high | Arcee AI | 10.0 | 4.8 | $0.592 | 1/1 | 5.96s |
| #328 | Ling 3.0 Tiny low | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.94s |
| #172 | KAT-Coder-Pro V2.5 none | Kwaipilot | 10.0 | 6.7 | $0.487 | 1/1 | 5.93s |
| #37 | Qwen3.8 Max (0902) medium | Qwen | 10.0 | 8.8 | $0.677 | 1/1 | 5.93s |
| #87 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 1/1 | 5.87s |
| #289 | Qwen3.6 Plus Preview medium | Qwen | 10.0 | 4.9 | $0.000 | 1/1 | 5.87s |
| #58 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.945 | 1/1 | 5.83s |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 1/1 | 5.83s | |
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 5.78s | |
| #327 | Ling 3.0 Tiny high | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.76s |
| #95 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 1/1 | 5.72s |