टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
210/210
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #179 | Ring-2.6-1T none | Inclusionai | 3.0 | 4.8 | $0.026 | 0/1 | 0ms |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 3.0 | 4.8 | $5.599 | 0/1 | 0ms |
| #193 | Elephant Alpha none | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.79s |
| #195 | Elephant Alpha medium | Openrouter | 3.0 | 4.3 | $0.000 | 0/1 | 2.83s |
| #202 | Grok Build 0.1 none | X AI | 3.0 | 4.0 | $0.547 | 0/1 | 0ms |
| #205 | Laguna Xs.2 none | Poolside | 3.0 | 3.8 | $0.004 | 0/1 | 1.93s |
| #206 | gpt-oss-120b none | OpenAI | 3.0 | 3.7 | $0.010 | 0/1 | 0ms |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 3.0 | 3.4 | $0.000 | 0/1 | 0ms |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.0 | 3.2 | $0.000 | 0/1 | 0ms |
| #209 | Step 3.5 Flash none | Stepfun | 3.0 | 2.3 | $0.020 | 0/1 | 0ms |
| #210 | LFM2-24B-A2B none | Liquid | 3.0 | 2.2 | $0.001 | 0/1 | 0ms |
| #153 | Hy3 preview low | Tencent | 2.8 | 5.5 | $0.015 | 0/1 | 17.8s |
| #176 | GLM 4.7 Flash none | Z.ai | 2.8 | 4.9 | $0.016 | 0/1 | 7.05s |
| #185 | Grok 4.1 Fast medium | X AI | 2.8 | 4.7 | $0.069 | 0/1 | 27.7s |
| #203 | Grok 4.1 Fast none | X AI | 2.8 | 3.8 | $0.008 | 0/1 | 5.51s |