टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #76 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.721 | 1/1 | 9.25s |
| #78 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |
| #80 | GPT-5.2 Chat none | OpenAI | 10.0 | 7.9 | $0.594 | 1/1 | 4.68s |
| #81 | Step 3.7 Flash medium | Stepfun | 10.0 | 7.9 | $0.495 | 1/1 | 4.16s |
| #83 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 1/1 | 15.0s |
| #84 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 1/1 | 5.87s |
| #85 | Gemini 3.5 Flash Lite medium | 10.0 | 7.8 | $0.272 | 1/1 | 2.84s | |
| #86 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.324 | 1/1 | 20.4s |
| #87 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 1/1 | 5.09s |
| #88 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 1/1 | 7.48s |
| #90 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 1/1 | 12.4s |
| #91 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 1/1 | 6.85s |
| #92 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |
| #93 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 1/1 | 15.9s |
| #94 | Seed-2.0-Code low | Bytedance Seed | 10.0 | 7.7 | $0.767 | 1/1 | 55.6s |