टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
216/216
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #126 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #127 | gpt-oss-120b medium | OpenAI | 9.8 | 6.1 | $0.019 | 1/1 | 6.91s |
| #128 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 1/1 | 2.97s | |
| #130 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 2.49s |
| #131 | Qwen3.5-Flash none | Qwen | 10.0 | 6.1 | $0.073 | 1/1 | 3.67s |
| #132 | Qwen3.5 Plus 2026-04-20 none | Qwen | 10.0 | 6.1 | $0.122 | 1/1 | 4.42s |
| #133 | Qwen3.5-35B-A3B none | Qwen | 10.0 | 6.1 | $0.106 | 1/1 | 2.30s |
| #134 | GPT-5 Nano medium | OpenAI | 10.0 | 6.1 | $0.114 | 1/1 | 33.3s |
| #135 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.095 | 1/1 | 2.99s |
| #136 | Step 3.5 Flash medium | Stepfun | 10.0 | 6.0 | $0.108 | 1/1 | 11.9s |
| #138 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.349 | 1/1 | 3.10s |
| #139 | Gemini 3 PRO Preview medium | 10.0 | 6.0 | $0.385 | 1/1 | 12.0s | |
| #140 | Mimo V2 Omni medium | Xiaomi | 10.0 | 5.9 | $0.683 | 1/1 | 14.0s |
| #141 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.048 | 1/1 | 78.8s |
| #143 | North Mini Code medium | Cohere | 10.0 | 5.9 | $0.000 | 1/1 | 3.93s |