टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #139 | Mercury 2.5 high | Inception | 10.0 | 7.1 | $0.031 | 1/1 | 3.06s |
| #140 | Grok 4.3 medium | X AI | 10.0 | 7.0 | $0.741 | 1/1 | 17.7s |
| #141 | GPT-5.6 Sol none | OpenAI | 10.0 | 7.0 | $0.201 | 1/1 | 3.70s |
| #142 | DeepSeek V3.2 medium | DeepSeek | 10.0 | 7.0 | $0.078 | 1/1 | 34.8s |
| #144 | GPT-5.5 none | OpenAI | 10.0 | 7.0 | $0.544 | 1/1 | 3.90s |
| #145 | Mercury 2 medium | Inception | 10.0 | 7.0 | $0.094 | 1/1 | 1.89s |
| #147 | Seed-2.0-Mini medium | Bytedance Seed | 10.0 | 7.0 | $0.116 | 1/1 | 88.7s |
| #148 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.479 | 1/1 | 31.7s |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 10.0 | 6.9 | $0.478 | 1/1 | 19.0s |
| #150 | Claude Fable 5.1 low | Anthropic | 10.0 | 6.9 | $2.565 | 1/1 | 13.2s |
| #151 | Qwen3.7 Flash medium | Qwen | 10.0 | 6.9 | $0.065 | 1/1 | 7.80s |
| #154 | Qwen3.6 Flash medium | Qwen | 10.0 | 6.8 | $0.741 | 1/1 | 4.00s |
| #155 | Step 3.7 Flash high | Stepfun | 10.0 | 6.8 | $1.229 | 1/1 | 2.79s |
| #157 | Solar Pro 4 low | Upstage | 10.0 | 6.8 | $0.130 | 1/1 | 7.12s |
| #158 | Solar Pro 4 medium | Upstage | 10.0 | 6.8 | $0.140 | 1/1 | 7.86s |