टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #68 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.2 | $0.922 | 1/1 | 10.7s |
| #69 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 1/1 | 25.9s |
| #70 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 1/1 | 18.6s |
| #71 | Muse Glimmer 30B xhigh | Meta | 10.0 | 8.1 | $0.471 | 1/1 | 8.08s |
| #74 | DeepSeek V4 Flash 0731 low | DeepSeek | 10.0 | 8.0 | $0.031 | 1/1 | 4.44s |
| #75 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.058 | 1/1 | 5.42s |
| #76 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.721 | 1/1 | 9.25s |
| #78 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |
| #80 | GPT-5.2 Chat none | OpenAI | 10.0 | 7.9 | $0.594 | 1/1 | 4.68s |
| #81 | Step 3.7 Flash medium | Stepfun | 10.0 | 7.9 | $0.495 | 1/1 | 4.16s |
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 1/1 | 15.0s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 1/1 | 5.87s |
| #85 | Gemini 3.5 Flash Lite medium | 10.0 | 7.8 | $0.272 | 1/1 | 2.84s | |
| #86 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.324 | 1/1 | 20.4s |
| #87 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 1/1 | 5.09s |