टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #122 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 1/1 | 3.94s |
| #123 | GPT-5.6 Luna low | OpenAI | 10.0 | 6.2 | $0.249 | 1/1 | 4.43s |
| #124 | Gemini 2.5 Flash none | 10.0 | 6.2 | $0.017 | 1/1 | 1.91s | |
| #125 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.2 | $0.837 | 1/1 | 4.65s |
| #126 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #128 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 1/1 | 2.97s | |
| #130 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 2.49s |
| #131 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 3.67s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 10.0 | 6.1 | $0.122 | 1/1 | 4.42s |
| #133 | Qwen3.5-35B-A3B none | Qwen | 10.0 | 6.1 | $0.106 | 1/1 | 2.30s |
| #134 | GPT-5 Nano medium | OpenAI | 10.0 | 6.1 | $0.114 | 1/1 | 33.3s |
| #135 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.095 | 1/1 | 2.99s |
| #136 | Step 3.5 Flash medium | Stepfun | 10.0 | 6.0 | $0.108 | 1/1 | 11.9s |
| #139 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 12.0s | |
| #140 | Mimo V2 Omni medium | Xiaomi | 10.0 | 5.9 | $0.683 | 1/1 | 14.0s |