टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #50 | Qwen3.8 Max low | Qwen | 10.0 | 8.6 | $0.702 | 1/1 | 8.06s |
| #102 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 1/1 | 7.89s |
| #158 | Solar Pro 4 medium | Upstage | 10.0 | 6.8 | $0.140 | 1/1 | 7.86s |
| #29 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 1/1 | 7.83s |
| #151 | Qwen3.7 Flash medium | Qwen | 10.0 | 6.9 | $0.065 | 1/1 | 7.80s |
| #261 | Gemini 3.1 Flash Lite Preview high | 10.0 | 5.3 | $2.310 | 1/1 | 7.73s | |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.6 | $0.701 | 1/1 | 7.72s |
| #103 | GPT-5.4 Nano medium | OpenAI | 10.0 | 7.5 | $0.142 | 1/1 | 7.71s |
| #133 | Qwen3.7 Flash low | Qwen | 10.0 | 7.2 | $0.043 | 1/1 | 7.66s |
| #8 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.357 | 1/1 | 7.56s |
| #107 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 1/1 | 7.54s |
| #304 | Laguna M.1 none | Poolside | 10.0 | 4.4 | $0.009 | 1/1 | 7.54s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 1/1 | 7.48s |
| #108 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 1/1 | 7.45s |
| #159 | DeepSeek V4 Pro none | DeepSeek | 10.0 | 6.8 | $0.351 | 1/1 | 7.40s |