टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #116 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 1/1 | 6.02s |
| #117 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.499 | 1/1 | 10.7s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 1/1 | 32.9s |
| #119 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 1/1 | 14.4s |
| #120 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 1/1 | 4.99s | |
| #121 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |
| #122 | GLM 5.3 high | Z.ai | 10.0 | 7.3 | $0.403 | 1/1 | 17.0s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 1/1 | 18.4s |
| #124 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.034 | 1/1 | 15.6s |
| #125 | Gemini 3.1 Flash Lite medium | 10.0 | 7.3 | $0.120 | 1/1 | 4.55s | |
| #126 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 1/1 | 3.54s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 10.0 | 7.3 | $0.046 | 1/1 | 4.41s |
| #128 | Claude Opus 4.8 none | Anthropic | 10.0 | 7.3 | $1.166 | 1/1 | 5.35s |
| #129 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.247 | 1/1 | 8.92s |