टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #310 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |
| #198 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $1.172 | 1/1 | 4.65s |
| #80 | GPT-5.2 Chat none | OpenAI | 10.0 | 7.9 | $0.594 | 1/1 | 4.68s |
| #23 | Qwen3.8 Max (0902) low | Qwen | 10.0 | 9.1 | $0.664 | 1/1 | 4.73s |
| #171 | Claude Opus 4.7 none | Anthropic | 10.0 | 6.6 | $0.505 | 1/1 | 4.74s |
| #241 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 1/1 | 4.77s |
| #235 | KAT-Coder-Air V2.5 high | Kwaipilot | 10.0 | 5.6 | $0.077 | 1/1 | 4.77s |
| #303 | Grok 4.20 Beta none | X AI | 10.0 | 4.4 | $0.087 | 1/1 | 4.79s |
| #236 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #323 | Ling 3.0 Tiny medium | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 4.91s |
| #266 | Nemotron 3.5 Lightning medium | NVIDIA | 10.0 | 5.1 | $0.156 | 1/1 | 4.92s |
| #9 | GPT-6 Astra low | OpenAI | 10.0 | 9.5 | $1.289 | 1/1 | 4.95s |
| #11 | Gemini 3.5 Flash high | 9.8 | 9.4 | $2.011 | 1/1 | 4.96s | |
| #16 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 1/1 | 4.96s |
| #78 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |