टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #206 | Gemma 4 31B none | 3.0 | 6.1 | $0.016 | 0/1 | 0ms | |
| #318 | Mercury 2.5 none | Inception | 10.0 | 3.9 | $0.016 | 1/1 | 1.23s |
| #292 | GLM 4.7 Flash none | Z.ai | 2.8 | 4.8 | $0.016 | 0/1 | 7.05s |
| #260 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/1 | 25.7s |
| #311 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #269 | Granite 4.2 8B low | IBM Granite | 10.0 | 5.1 | $0.012 | 1/1 | 2.23s |
| #271 | Mercury 2.5 low | Inception | 9.8 | 5.1 | $0.011 | 1/1 | 2.72s |
| #277 | Mercury 2.5 Preview low | Inception | 2.8 | 5.0 | $0.011 | 0/1 | 1.57s |
| #280 | GPT-4o-mini none | OpenAI | 10.0 | 5.0 | $0.010 | 1/1 | 2.51s |
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.009 | 1/1 | 4.61s |
| #304 | Laguna M.1 none | Poolside | 10.0 | 4.4 | $0.009 | 1/1 | 7.54s |
| #265 | Granite 4.2 8B medium | IBM Granite | 10.0 | 5.2 | $0.008 | 1/1 | 2.28s |
| #284 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.8 | $0.008 | 0/1 | 16.0s |
| #293 | Trinity Large Preview none | Arcee AI | 10.0 | 4.8 | $0.008 | 1/1 | 6.67s |
| #321 | Grok 4.1 Fast none | X AI | 2.8 | 3.8 | $0.008 | 0/1 | 5.51s |