टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #152 | Seed-2.0-Code high | Bytedance Seed | 4.7 | 6.9 | $1.273 | 0/1 | 35.1s |
| #9 | GPT-6 Astra low | OpenAI | 10.0 | 9.5 | $1.289 | 1/1 | 4.95s |
| #46 | Muse Spark 1.2 medium | Meta | 10.0 | 8.6 | $1.339 | 1/1 | 3.89s |
| #18 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 1/1 | 23.1s | |
| #47 | Muse Spark 1.1 medium | Meta | 9.8 | 8.6 | $1.420 | 1/1 | 6.99s |
| #38 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #44 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 1/1 | 4.17s |
| #24 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 1/1 | 27.4s |
| #102 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 1/1 | 7.89s |
| #51 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 1/1 | 13.3s |
| #21 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 1/1 | 8.76s |
| #2 | Gemini 3.8 Flash high | 10.0 | 9.9 | $1.595 | 1/1 | 42.6s | |
| #33 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |
| #57 | Grok 4.6 medium | X AI | 10.0 | 8.4 | $1.713 | 1/1 | 12.8s |
| #76 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.721 | 1/1 | 9.25s |