Peringkat Pemanggilan alat
Lihat model AI mana yang paling baik di Pemanggilan alat, mana yang tetap andal, dan di mana kesenjangan terbesar muncul. Urutkan berdasarkan: Waktu respons (rata-rata) ↓.
330/330
Filter model
Tidak ada model yang cocok dengan pencarian dan filter saat ini.
| Peringkat | Model | Perusahaan | Skor Pemanggilan alat | Skor | Total Biaya | Tes benar | Waktu respons (rata-rata) |
|---|---|---|---|---|---|---|---|
| #78 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |
| #16 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 1/1 | 4.96s |
| #11 | Gemini 3.5 Flash high | 9.8 | 9.4 | $2.011 | 1/1 | 4.96s | |
| #9 | GPT-6 Astra low | OpenAI | 10.0 | 9.5 | $1.289 | 1/1 | 4.95s |
| #266 | Nemotron 3.5 Lightning medium | NVIDIA | 10.0 | 5.1 | $0.156 | 1/1 | 4.92s |
| #323 | Ling 3.0 Tiny medium | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 4.91s |
| #236 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #303 | Grok 4.20 Beta none | X AI | 10.0 | 4.4 | $0.087 | 1/1 | 4.79s |
| #235 | KAT-Coder-Air V2.5 high | Kwaipilot | 10.0 | 5.6 | $0.077 | 1/1 | 4.77s |
| #241 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 1/1 | 4.77s |
| #171 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 1/1 | 4.74s |
| #23 | Qwen3.8 Max (0902) low | Qwen | 10.0 | 9.1 | $0.664 | 1/1 | 4.73s |
| #80 | GPT-5.2 Chat none | OpenAI | 10.0 | 7.9 | $0.594 | 1/1 | 4.68s |
| #198 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $1.172 | 1/1 | 4.65s |
| #310 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |