टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #18 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.533 | 1/1 | 13.3s |
| #19 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.4 | $1.143 | 1/1 | 18.3s |
| #20 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.935 | 1/1 | 5.83s |
| #22 | Grok 4.5 medium | X AI | 10.0 | 8.3 | $1.928 | 1/1 | 6.57s |
| #23 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.3 | $0.922 | 1/1 | 10.7s |
| #25 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.643 | 1/1 | 6.20s | |
| #26 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.237 | 1/1 | 18.6s |
| #29 | Step 3.7 Flash medium | Stepfun | 10.0 | 8.0 | $0.515 | 1/1 | 4.16s |
| #30 | GPT-5.2 Chat none | OpenAI | 10.0 | 8.0 | $0.604 | 1/1 | 4.68s |
| #31 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.970 | 1/1 | 9.25s |
| #34 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $1.055 | 1/1 | 4.97s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 1/1 | 12.4s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 1/1 | 15.0s |
| #37 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 1/1 | 5.87s |
| #38 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.222 | 1/1 | 20.4s |