टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #16 | Muse Spark 1.1 medium | Meta | 9.8 | 8.6 | $1.357 | 1/1 | 6.99s |
| #17 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.478 | 1/1 | 17.0s |
| #18 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.533 | 1/1 | 13.3s |
| #19 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.4 | $1.143 | 1/1 | 18.3s |
| #20 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.935 | 1/1 | 5.83s |
| #22 | Grok 4.5 medium | X AI | 10.0 | 8.3 | $1.928 | 1/1 | 6.57s |
| #23 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.3 | $0.922 | 1/1 | 10.7s |
| #24 | Muse Spark 1.1 low | Meta | 9.8 | 8.3 | $0.647 | 1/1 | 5.98s |
| #25 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.643 | 1/1 | 6.20s | |
| #26 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.237 | 1/1 | 18.6s |
| #27 | Muse Spark 1.1 high | Meta | 9.6 | 8.1 | $1.694 | 1/1 | 9.88s |
| #29 | Step 3.7 Flash medium | Stepfun | 10.0 | 8.0 | $0.515 | 1/1 | 4.16s |
| #30 | GPT-5.2 Chat none | OpenAI | 10.0 | 8.0 | $0.604 | 1/1 | 4.68s |
| #31 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.970 | 1/1 | 9.25s |
| #34 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $1.055 | 1/1 | 4.97s |