टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #143 | GLM 5.1 medium | Z.ai | 3.0 | 7.0 | $0.727 | 0/1 | 0ms |
| #146 | Grok 4.20 medium | X AI | 3.0 | 7.0 | $0.805 | 0/1 | 13.7s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #153 | Gemini 3.5 Flash none | 3.0 | 6.9 | $1.093 | 0/1 | 0ms | |
| #156 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #169 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #175 | Inkling Small medium | Thinkingmachines | 3.0 | 6.6 | $0.113 | 0/1 | 2.12s |
| #177 | Qwen3.6 35B A3B medium | Qwen | 3.0 | 6.6 | $0.672 | 0/1 | 0ms |
| #178 | Mercury 2.5 Preview high | Inception | 3.0 | 6.6 | $0.030 | 0/1 | 2.25s |
| #194 | Gemma 4 31B medium | 3.0 | 6.2 | $0.100 | 0/1 | 0ms | |
| #203 | Inkling low | Thinkingmachines | 3.0 | 6.1 | $0.187 | 0/1 | 2.57s |
| #206 | Gemma 4 31B none | 3.0 | 6.1 | $0.016 | 0/1 | 0ms | |
| #211 | Grok 4.20 Beta medium | X AI | 3.0 | 6.0 | $0.750 | 0/1 | 12.4s |
| #222 | GPT-5.4 Mini none | OpenAI | 3.0 | 5.9 | $0.095 | 0/1 | 2.32s |
| #229 | Inkling Small low | Thinkingmachines | 3.0 | 5.7 | $0.055 | 0/1 | 2.21s |