टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #240 | Owl Alpha none | Openrouter | 10.0 | 5.6 | $0.000 | 1/1 | 22.8s |
| #3 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $3.803 | 1/1 | 20.6s |
| #86 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.324 | 1/1 | 20.4s |
| #223 | Seed 2.1 Turbo none | Bytedance Seed | 10.0 | 5.9 | $0.092 | 1/1 | 20.3s |
| #43 | GLM 5.3 Flash max | Z.ai | 10.0 | 8.7 | $0.071 | 1/1 | 19.2s |
| #149 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 10.0 | 6.9 | $0.478 | 1/1 | 19.0s |
| #283 | Ling-2.6-flash none | Inclusionai | 3.0 | 4.9 | $0.002 | 0/1 | 18.8s |
| #70 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 1/1 | 18.6s |
| #22 | Gemini 3.8 Flash medium | 10.0 | 9.1 | $0.653 | 1/1 | 18.5s | |
| #160 | GLM 5.3 low | Z.ai | 10.0 | 6.8 | $0.257 | 1/1 | 18.5s |
| #123 | KAT-Coder-Pro V2.5 low | Kwaipilot | 10.0 | 7.3 | $0.400 | 1/1 | 18.4s |
| #49 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 1/1 | 18.3s |
| #245 | Hy3 preview low | Tencent | 2.8 | 5.5 | $0.042 | 0/1 | 17.8s |
| #140 | Grok 4.3 medium | X AI | 10.0 | 7.0 | $0.741 | 1/1 | 17.7s |
| #294 | Hunter Alpha medium | OpenRouter | 10.0 | 4.7 | $0.000 | 1/1 | 17.3s |