टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #184 | Hunter Alpha medium | OpenRouter | 10.0 | 4.7 | $0.000 | 1/1 | 17.3s |
| #186 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 1/1 | 6.31s |
| #187 | Qwen3 Coder Next medium | Qwen | 10.0 | 4.7 | $0.032 | 1/1 | 2.64s |
| #188 | Cobuddy medium | Baidu | 10.0 | 4.7 | $0.000 | 1/1 | 11.2s |
| #189 | Mercury 2 none | Inception | 10.0 | 4.6 | $0.030 | 1/1 | 1.27s |
| #190 | MiniMax M2.5 medium | Minimax | 10.0 | 4.6 | $0.340 | 1/1 | 15.4s |
| #191 | Grok 4.20 Beta none | X AI | 10.0 | 4.4 | $0.087 | 1/1 | 4.79s |
| #192 | Laguna M.1 none | Poolside | 10.0 | 4.4 | $0.009 | 1/1 | 7.54s |
| #194 | GLM 4.7 Flash medium | Z.ai | 10.0 | 4.3 | $0.166 | 1/1 | 15.9s |
| #196 | Hunter Alpha none | OpenRouter | 10.0 | 4.2 | $0.000 | 1/1 | 6.02s |
| #197 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |
| #199 | Hy3 preview none | Tencent | 10.0 | 4.0 | $0.003 | 1/1 | 33.8s |
| #200 | MiMo-V2-Flash none | Xiaomi | 10.0 | 4.0 | $0.025 | 1/1 | 2.28s |
| #201 | Granite 4.1 8B none | IBM Granite | 10.0 | 4.0 | $0.007 | 1/1 | 2.17s |
| #204 | Qwen3.5-9B medium | Qwen | 10.0 | 3.8 | $0.036 | 1/1 | 4.31s |