टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #41 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 1/1 | 5.87s |
| #42 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.187 | 1/1 | 20.4s |
| #43 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.676 | 1/1 | 5.09s |
| #44 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.057 | 1/1 | 7.48s |
| #45 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.077 | 1/1 | 6.85s |
| #46 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 1/1 | 15.9s |
| #47 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $3.059 | 1/1 | 9.73s |
| #48 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.7 | $1.017 | 1/1 | 4.98s |
| #49 | DeepSeek V4 Flash high | DeepSeek | 10.0 | 7.7 | $0.041 | 1/1 | 74.7s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 9.8 | 7.7 | $0.200 | 1/1 | 15.9s |
| #51 | MiniMax M3 medium | Minimax | 10.0 | 7.6 | $0.286 | 1/1 | 11.9s |
| #52 | Grok Build 0.1 medium | X AI | 10.0 | 7.6 | $1.097 | 1/1 | 13.1s |
| #53 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #54 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.6 | $0.352 | 1/1 | 6.02s |
| #55 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.5 | $0.774 | 1/1 | 7.72s |