टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #279 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 1/1 | 11.8s |
| #280 | GPT-4o-mini none | OpenAI | 10.0 | 5.0 | $0.010 | 1/1 | 2.51s |
| #281 | Qwen3.6 Plus Preview medium | Qwen | 10.0 | 4.9 | $0.000 | 1/1 | 5.87s |
| #282 | Mercury 2.5 Preview none | Inception | 10.0 | 4.9 | $0.018 | 1/1 | 1.29s |
| #287 | Nemotron 3.5 Lightning low | NVIDIA | 10.0 | 4.8 | $0.140 | 1/1 | 5.08s |
| #288 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #289 | Trinity Large Thinking high | Arcee AI | 10.0 | 4.8 | $0.592 | 1/1 | 5.96s |
| #291 | KAT-Coder-Air V2.5 none | Kwaipilot | 10.0 | 4.8 | $0.070 | 1/1 | 5.13s |
| #293 | Trinity Large Preview none | Arcee AI | 10.0 | 4.8 | $0.008 | 1/1 | 6.67s |
| #294 | Hunter Alpha medium | OpenRouter | 10.0 | 4.7 | $0.000 | 1/1 | 17.3s |
| #296 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 1/1 | 6.31s |
| #297 | Cobuddy medium | Baidu | 10.0 | 4.7 | $0.000 | 1/1 | 11.2s |
| #298 | Mercury 2 none | Inception | 10.0 | 4.7 | $0.030 | 1/1 | 1.27s |
| #299 | Granite 4.2 8B high | IBM Granite | 10.0 | 4.6 | $0.135 | 1/1 | 15.1s |
| #300 | Qwen3 Coder Next medium | Qwen | 10.0 | 4.6 | $0.034 | 1/1 | 2.64s |