टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #261 | Gemini 3.1 Flash Lite Preview high | 10.0 | 5.3 | $2.310 | 1/1 | 7.73s | |
| #73 | Muse Spark 1.1 high | Meta | 9.6 | 8.0 | $2.253 | 1/1 | 9.88s |
| #30 | Grok 4.5 high | X AI | 10.0 | 9.0 | $2.252 | 1/1 | 5.71s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 1/1 | 7.48s |
| #91 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 1/1 | 6.85s |
| #234 | Gemini 3.1 Flash Lite high | 10.0 | 5.6 | $2.044 | 1/1 | 6.44s | |
| #55 | Grok 4.5 medium | X AI | 10.0 | 8.5 | $2.042 | 1/1 | 6.57s |
| #11 | Gemini 3.5 Flash high | 9.8 | 9.4 | $2.011 | 1/1 | 4.96s | |
| #40 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 1/1 | 8.96s |
| #61 | Seed 2.1 Turbo medium | Bytedance Seed | 10.0 | 8.4 | $1.951 | 1/1 | 27.5s |
| #17 | Grok 4.6 high | X AI | 10.0 | 9.3 | $1.908 | 1/1 | 13.3s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 1/1 | 26.0s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 1/1 | 5.72s |
| #45 | Muse Spark 1.2 high | Meta | 10.0 | 8.7 | $1.771 | 1/1 | 4.00s |
| #243 | Hy4 preview low | Tencent | 3.0 | 5.6 | $1.745 | 0/1 | 93.7s |