टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #220 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.135 | 1/1 | 78.8s |
| #221 | GLM 5.3 Flash low | Z.ai | 10.0 | 5.9 | $0.018 | 1/1 | 17.0s |
| #223 | Seed 2.1 Turbo none | Bytedance Seed | 10.0 | 5.9 | $0.092 | 1/1 | 20.3s |
| #224 | GPT-5.4 none | OpenAI | 10.0 | 5.8 | $0.397 | 1/1 | 2.75s |
| #225 | Solar Pro 4 none | Upstage | 10.0 | 5.8 | $0.017 | 1/1 | 3.83s |
| #226 | North Mini Code medium | Cohere | 10.0 | 5.7 | $0.000 | 1/1 | 3.93s |
| #227 | Nemotron 3 Super medium | NVIDIA | 10.0 | 5.7 | $0.054 | 1/1 | 39.7s |
| #228 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 1/1 | 11.1s |
| #230 | Ling-3.0-flash none | Inclusionai | 10.0 | 5.7 | $0.004 | 1/1 | 2.85s |
| #231 | GLM 5.1 none | Z.ai | 10.0 | 5.7 | $0.164 | 1/1 | 10.7s |
| #232 | Kimi K2.6 none | Moonshot AI | 10.0 | 5.7 | $0.233 | 1/1 | 4.46s |
| #233 | Qwen3.5-122B-A10B none | Qwen | 10.0 | 5.7 | $0.247 | 1/1 | 2.04s |
| #234 | Gemini 3.1 Flash Lite high | 10.0 | 5.6 | $2.044 | 1/1 | 6.44s | |
| #235 | KAT-Coder-Air V2.5 high | Kwaipilot | 10.0 | 5.6 | $0.077 | 1/1 | 4.77s |
| #236 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |