टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #301 | MiniMax M2.5 medium | Minimax | 10.0 | 4.6 | $0.327 | 1/1 | 15.4s |
| #303 | Grok 4.20 Beta none | X AI | 10.0 | 4.4 | $0.087 | 1/1 | 4.79s |
| #304 | Laguna M.1 none | Poolside | 10.0 | 4.4 | $0.009 | 1/1 | 7.54s |
| #306 | GLM 4.7 Flash medium | Z.ai | 10.0 | 4.3 | $0.168 | 1/1 | 15.9s |
| #308 | Granite 4.2 8B none | IBM Granite | 10.0 | 4.3 | $0.037 | 1/1 | 1.39s |
| #309 | Hunter Alpha none | OpenRouter | 10.0 | 4.2 | $0.000 | 1/1 | 6.02s |
| #310 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |
| #312 | Hy3 preview none | Tencent | 10.0 | 4.0 | $0.007 | 1/1 | 33.8s |
| #313 | MiMo-V2-Flash none | Xiaomi | 10.0 | 4.0 | $0.025 | 1/1 | 2.28s |
| #315 | Granite 4.1 8B none | IBM Granite | 10.0 | 4.0 | $0.007 | 1/1 | 2.17s |
| #318 | Mercury 2.5 none | Inception | 10.0 | 3.9 | $0.016 | 1/1 | 1.23s |
| #319 | Ling 3.0 Tiny high | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.76s |
| #320 | Ling 3.0 Tiny low | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.94s |
| #322 | Qwen3.5-9B medium | Qwen | 10.0 | 3.8 | $0.062 | 1/1 | 4.31s |
| #323 | Ling 3.0 Tiny medium | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 4.91s |