टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #95 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $2.961 | 1/1 | 9.73s |
| #97 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 7.6 | $0.042 | 1/1 | 74.7s |
| #98 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #99 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 1/1 | 4.98s |
| #100 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.150 | 1/1 | 9.87s |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.6 | $0.701 | 1/1 | 7.72s |
| #102 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 1/1 | 7.89s |
| #103 | GPT-5.4 Nano medium | OpenAI | 10.0 | 7.5 | $0.142 | 1/1 | 7.71s |
| #105 | MiniMax M3 medium | Minimax | 10.0 | 7.5 | $0.300 | 1/1 | 11.9s |
| #106 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 1/1 | 8.36s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 1/1 | 7.54s |
| #108 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 1/1 | 7.45s |
| #111 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 1/1 | 13.1s |
| #112 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 1/1 | 5.51s | |
| #113 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s |