टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #73 | KAT-Coder-Pro V2.5 high | Kwaipilot | 10.0 | 7.2 | $0.482 | 1/1 | 28.0s |
| #74 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.317 | 1/1 | 14.7s |
| #75 | Qwen3.7 Plus none | Qwen | 10.0 | 7.2 | $0.106 | 1/1 | 3.54s |
| #76 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.046 | 1/1 | 4.60s |
| #77 | Grok 4.3 medium | X AI | 10.0 | 7.1 | $0.779 | 1/1 | 17.7s |
| #80 | DeepSeek V3.2 medium | DeepSeek | 10.0 | 7.0 | $0.078 | 1/1 | 34.8s |
| #81 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.600 | 1/1 | 31.7s |
| #82 | Mercury 2 medium | Inception | 10.0 | 7.0 | $0.093 | 1/1 | 1.89s |
| #84 | Seed-2.0-Mini medium | Bytedance Seed | 10.0 | 7.0 | $0.101 | 1/1 | 88.7s |
| #85 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 10.0 | 6.9 | $0.467 | 1/1 | 19.0s |
| #86 | DeepSeek V4 Pro none | DeepSeek | 10.0 | 6.9 | $0.096 | 1/1 | 7.40s |
| #87 | GPT-5.6 Sol none | OpenAI | 10.0 | 6.9 | $0.524 | 1/1 | 3.70s |
| #88 | MiMo-V2.5-Pro medium | Xiaomi | 10.0 | 6.9 | $0.187 | 1/1 | 16.9s |
| #89 | Qwen3.6 Flash medium | Qwen | 10.0 | 6.9 | $0.738 | 1/1 | 4.00s |
| #90 | Step 3.7 Flash high | Stepfun | 10.0 | 6.9 | $1.207 | 1/1 | 2.79s |