टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #86 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.324 | 1/1 | 20.4s |
| #87 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 1/1 | 5.09s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 1/1 | 7.48s |
| #90 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 1/1 | 12.4s |
| #91 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 1/1 | 6.85s |
| #92 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |
| #93 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 1/1 | 15.9s |
| #94 | Seed-2.0-Code low | Bytedance Seed | 10.0 | 7.7 | $0.767 | 1/1 | 55.6s |
| #95 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $2.961 | 1/1 | 9.73s |
| #96 | DeepSeek V4 Pro high | DeepSeek | 9.8 | 7.7 | $0.761 | 1/1 | 15.9s |
| #97 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 7.6 | $0.042 | 1/1 | 74.7s |
| #98 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 1/1 | 9.84s |
| #99 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 1/1 | 4.98s |
| #100 | Solar Pro 4 xhigh | Upstage | 10.0 | 7.6 | $0.150 | 1/1 | 9.87s |
| #101 | Nemotron 3 Ultra medium | NVIDIA | 10.0 | 7.6 | $0.701 | 1/1 | 7.72s |