टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #131 | Grok 4.20 Beta medium | X AI | 3.0 | 6.0 | $0.750 | 0/1 | 12.4s |
| #136 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 2.32s |
| #153 | Hy3 preview low | Tencent | 2.8 | 5.5 | $0.015 | 0/1 | 17.8s |
| #161 | Qwen3.6 35B A3B none | Qwen | 3.0 | 5.3 | $0.061 | 0/1 | 0ms |
| #162 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/1 | 25.7s |
| #164 | Inkling none | Thinkingmachines | 3.0 | 5.2 | $0.147 | 0/1 | 2.50s |
| #172 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.163 | 0/1 | 12.0s |
| #176 | GLM 4.7 Flash none | Z.ai | 2.8 | 4.9 | $0.016 | 0/1 | 7.05s |
| #177 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.9 | $0.008 | 0/1 | 16.0s |
| #178 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/1 | 18.8s |
| #179 | Ring-2.6-1T none | Inclusionai | 3.0 | 4.8 | $0.026 | 0/1 | 0ms |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 3.0 | 4.8 | $5.599 | 0/1 | 0ms |
| #185 | Grok 4.1 Fast medium | X AI | 2.8 | 4.7 | $0.069 | 0/1 | 27.7s |
| #193 | Elephant Alpha none | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.79s |
| #195 | Elephant Alpha medium | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.83s |