टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #98 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #99 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 1/1 | 4.98s |
| #100 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.150 | 1/1 | 9.87s |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.6 | $0.701 | 1/1 | 7.72s |
| #102 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 1/1 | 7.89s |
| #103 | GPT-5.4 Nano medium | OpenAI | 10.0 | 7.5 | $0.142 | 1/1 | 7.71s |
| #105 | MiniMax M3 medium | Minimax | 10.0 | 7.5 | $0.300 | 1/1 | 11.9s |
| #106 | GPT 5.3 Chat none | OpenAI | 10.0 | 7.5 | $0.533 | 1/1 | 8.36s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 1/1 | 7.54s |
| #108 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 1/1 | 7.45s |
| #111 | Grok Build 0.1 medium | X AI | 10.0 | 7.5 | $1.130 | 1/1 | 13.1s |
| #112 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 1/1 | 5.51s | |
| #113 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s | |
| #114 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |
| #116 | GPT-5.6 Luna medium | OpenAI | 10.0 | 7.4 | $0.072 | 1/1 | 6.02s |