टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #119 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 1/1 | 14.4s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 10.0 | 8.5 | $0.448 | 1/1 | 13.8s |
| #15 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 1/1 | 7.08s |
| #7 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 1/1 | 5.78s | |
| #104 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 1/1 | 5.87s |
| #167 | LongCat 2.0 low | Meituan | 10.0 | 6.7 | $0.412 | 1/1 | 10.8s |
| #122 | GLM 5.3 high | Z.ai | 10.0 | 7.3 | $0.403 | 1/1 | 17.0s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 1/1 | 18.4s |
| #62 | Inkling Small high | Thinkingmachines | 3.0 | 8.4 | $0.398 | 0/1 | 2.91s |
| #131 | Muse Glimmer 30B high | Meta | 10.0 | 7.2 | $0.397 | 1/1 | 6.41s |
| #224 | GPT-5.4 none | OpenAI | 10.0 | 5.8 | $0.397 | 1/1 | 2.75s |
| #137 | Step 3.7 Flash low | Stepfun | 10.0 | 7.1 | $0.390 | 1/1 | 3.25s |
| #213 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 12.0s | |
| #77 | Inkling medium | Thinkingmachines | 3.0 | 8.0 | $0.383 | 0/1 | 4.48s |