टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
220/220
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #50 | DeepSeek V4 Pro high | DeepSeek | 9.8 | 7.7 | $0.200 | 1/1 | 15.9s |
| #51 | MiniMax M3 medium | Minimax | 10.0 | 7.6 | $0.286 | 1/1 | 11.9s |
| #52 | Grok Build 0.1 medium | X AI | 10.0 | 7.6 | $1.097 | 1/1 | 13.1s |
| #53 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #54 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.6 | $0.352 | 1/1 | 6.02s |
| #55 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.5 | $0.774 | 1/1 | 7.72s |
| #57 | GPT-5.4 Nano medium | OpenAI | 10.0 | 7.5 | $0.138 | 1/1 | 7.71s |
| #58 | GPT-5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.571 | 1/1 | 8.36s |
| #61 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.437 | 1/1 | 7.54s |
| #62 | Qwen3.5-27B medium | Qwen | 10.0 | 7.4 | $1.627 | 1/1 | 7.45s |
| #63 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #64 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.478 | 1/1 | 10.7s |
| #65 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.177 | 1/1 | 4.99s | |
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.4 | $0.387 | 1/1 | 18.4s |
| #67 | Claude Sonnet 4.6 none | Anthropic | 10.0 | 7.3 | $0.661 | 1/1 | 4.11s |