टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #106 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 1/1 | 8.36s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 1/1 | 7.54s |
| #108 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 1/1 | 7.45s |
| #111 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 1/1 | 13.1s |
| #112 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 1/1 | 5.51s | |
| #113 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s | |
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #116 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 1/1 | 6.02s |
| #117 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.499 | 1/1 | 10.7s |
| #118 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 1/1 | 32.9s |
| #119 | Grok 4.6 low | X AI | 10.0 | 7.4 | $0.449 | 1/1 | 14.4s |
| #120 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 1/1 | 4.99s | |
| #121 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |
| #122 | GLM 5.3 high | Z.ai | 10.0 | 7.3 | $0.403 | 1/1 | 17.0s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 1/1 | 18.4s |