टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #63 | DeepSeek V4.1 Flash max | DeepSeek | 10.0 | 8.3 | $1.073 | 1/1 | 9.49s |
| #64 | Muse Spark 1.1 low | Meta | 9.8 | 8.3 | $0.673 | 1/1 | 5.98s |
| #65 | Claude Fable 5.1 medium | Anthropic | 10.0 | 8.3 | $2.909 | 1/1 | 13.0s |
| #66 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.644 | 1/1 | 6.20s | |
| #67 | Muse Spark 1.3 low | Meta | 10.0 | 8.2 | $0.689 | 1/1 | 7.39s |
| #68 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.2 | $0.922 | 1/1 | 10.7s |
| #69 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 1/1 | 25.9s |
| #70 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 1/1 | 18.6s |
| #71 | Muse Glimmer 30B xhigh | Meta | 10.0 | 8.1 | $0.471 | 1/1 | 8.08s |
| #73 | Muse Spark 1.1 high | Meta | 9.6 | 8.0 | $2.253 | 1/1 | 9.88s |
| #74 | DeepSeek V4 Flash 0731 low | DeepSeek | 10.0 | 8.0 | $0.031 | 1/1 | 4.44s |
| #75 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.058 | 1/1 | 5.42s |
| #76 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.721 | 1/1 | 9.25s |
| #78 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |
| #80 | GPT-5.2 Chat none | OpenAI | 10.0 | 7.9 | $0.594 | 1/1 | 4.68s |