टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #156 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #169 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #175 | Inkling Small medium | Thinkingmachines | 3.0 | 6.6 | $0.113 | 0/1 | 2.12s |
| #177 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.6 | $0.672 | 0/1 | 0ms |
| #178 | Mercury 2.5 Preview high | Inception | 3.0 | 6.6 | $0.030 | 0/1 | 2.25s |
| #194 | Gemma 4 31B medium | 3.0 | 6.2 | $0.100 | 0/1 | 0ms | |
| #203 | Inkling low | Thinkingmachines | 3.0 | 6.1 | $0.187 | 0/1 | 2.57s |
| #206 | Gemma 4 31B none | 3.0 | 6.1 | $0.016 | 0/1 | 0ms | |
| #211 | Grok 4.20 Beta medium | X AI | 3.0 | 6.0 | $0.750 | 0/1 | 12.4s |
| #222 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 2.32s |
| #229 | Inkling Small low | Thinkingmachines | 3.0 | 5.7 | $0.055 | 0/1 | 2.21s |
| #243 | Hy4 preview low | Tencent | 3.0 | 5.6 | $1.745 | 0/1 | 93.7s |
| #245 | Hy3 preview low | Tencent | 2.8 | 5.5 | $0.042 | 0/1 | 17.8s |
| #257 | Inkling Small none | Thinkingmachines | 3.0 | 5.3 | $0.054 | 0/1 | 2.31s |
| #260 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/1 | 25.7s |