टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #126 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #128 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 1/1 | 2.97s | |
| #130 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 2.49s |
| #131 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 3.67s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 10.0 | 6.1 | $0.122 | 1/1 | 4.42s |
| #133 | Qwen3.5-35B-A3B none | Qwen | 10.0 | 6.1 | $0.106 | 1/1 | 2.30s |
| #134 | GPT-5 Nano medium | OpenAI | 10.0 | 6.1 | $0.114 | 1/1 | 33.3s |
| #135 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.095 | 1/1 | 2.99s |
| #136 | Step 3.5 Flash medium | Stepfun | 10.0 | 6.0 | $0.108 | 1/1 | 11.9s |
| #139 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 12.0s | |
| #140 | Mimo V2 Omni medium | Xiaomi | 10.0 | 5.9 | $0.683 | 1/1 | 14.0s |
| #141 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.048 | 1/1 | 78.8s |
| #143 | North Mini Code medium | Cohere | 10.0 | 5.9 | $0.000 | 1/1 | 3.93s |
| #144 | Kimi K2.6 none | Moonshot AI | 10.0 | 5.8 | $0.184 | 1/1 | 4.46s |
| #145 | GPT-5.4 none | OpenAI | 10.0 | 5.8 | $0.397 | 1/1 | 2.75s |