टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
311/311
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #301 | Ling 3.0 Tiny high | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.76s |
| #302 | Ling 3.0 Tiny low | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 5.94s |
| #304 | Qwen3.5-9B medium | Qwen | 10.0 | 3.8 | $0.062 | 1/1 | 4.31s |
| #305 | Ling 3.0 Tiny medium | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 4.91s |
| #7 | Gemini 3.5 Flash high | 9.8 | 9.4 | $2.011 | 1/1 | 4.96s | |
| #38 | Muse Spark 1.1 medium | Meta | 9.8 | 8.6 | $1.420 | 1/1 | 6.99s |
| #51 | Muse Spark 1.1 low | Meta | 9.8 | 8.3 | $0.673 | 1/1 | 5.98s |
| #83 | DeepSeek V4 Pro high | DeepSeek | 9.8 | 7.7 | $0.489 | 1/1 | 15.9s |
| #184 | gpt-oss-120b medium | OpenAI | 9.8 | 6.1 | $0.020 | 1/1 | 6.91s |
| #26 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |
| #29 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #60 | Muse Spark 1.1 high | Meta | 9.6 | 8.0 | $2.253 | 1/1 | 9.88s |
| #197 | GPT-5.6 Terra none | OpenAI | 9.6 | 6.0 | $0.280 | 1/1 | 3.10s |
| #229 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.116 | 1/1 | 6.74s |
| #239 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.011 | 1/1 | 4.61s |