टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #330 | LFM2-24B-A2B none | Liquid | 3.0 | 2.2 | $0.001 | 0/1 | 0ms |
| #59 | GPT-5.2 medium | OpenAI | 4.7 | 8.4 | $1.182 | 0/1 | 10.3s |
| #104 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #110 | GPT-5.4 Mini medium | OpenAI | 4.7 | 7.5 | $0.786 | 0/1 | 9.62s |
| #152 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #156 | Seed-2.0-Code medium | Bytedance Seed | 4.7 | 6.8 | $1.153 | 0/1 | 36.4s |
| #276 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.208 | 0/1 | 12.0s |
| #284 | Nemotron 3 Super none | NVIDIA | 4.7 | 4.8 | $0.008 | 0/1 | 16.0s |
| #302 | Laguna S 2.1 none | Poolside | 4.7 | 4.5 | $0.022 | 0/1 | 1.45s |
| #311 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #169 | GLM 5V Turbo medium | Z.ai | 7.0 | 6.7 | $0.457 | 0/1 | 12.5s |
| #244 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.062 | 1/1 | 6.74s |
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.009 | 1/1 | 4.61s |
| #275 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #33 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |