टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #273 | Qwen3.5-9B none | Qwen | 10.0 | 5.1 | $0.021 | 1/1 | 1.27s |
| #274 | GLM 5 Turbo none | Z.ai | 10.0 | 5.1 | $0.047 | 1/1 | 8.21s |
| #275 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #278 | Laguna S 2.1 low | Poolside | 10.0 | 5.0 | $0.082 | 1/1 | 2.36s |
| #279 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 1/1 | 11.8s |
| #280 | GPT-4o-mini none | OpenAI | 10.0 | 5.0 | $0.010 | 1/1 | 2.51s |
| #281 | Qwen3.6 Plus Preview medium | Qwen | 10.0 | 4.9 | $0.000 | 1/1 | 5.87s |
| #282 | Mercury 2.5 Preview none | Inception | 10.0 | 4.9 | $0.018 | 1/1 | 1.29s |
| #287 | Nemotron 3.5 Lightning low | NVIDIA | 10.0 | 4.8 | $0.140 | 1/1 | 5.08s |
| #288 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #289 | Trinity Large Thinking high | Arcee AI | 10.0 | 4.8 | $0.592 | 1/1 | 5.96s |
| #291 | KAT-Coder-Air V2.5 none | Kwaipilot | 10.0 | 4.8 | $0.070 | 1/1 | 5.13s |
| #293 | Trinity Large Preview none | Arcee AI | 10.0 | 4.8 | $0.008 | 1/1 | 6.67s |
| #294 | Hunter Alpha medium | OpenRouter | 10.0 | 4.7 | $0.000 | 1/1 | 17.3s |
| #296 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 1/1 | 6.31s |