टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.009 | 1/1 | 4.61s |
| #135 | Qwen3.5-122B-A10B medium | Qwen | 10.0 | 7.1 | $1.047 | 1/1 | 4.60s |
| #125 | Gemini 3.1 Flash Lite medium | 10.0 | 7.3 | $0.120 | 1/1 | 4.55s | |
| #39 | Gemini 3.5 Flash Lite high | 10.0 | 8.8 | $0.540 | 1/1 | 4.55s | |
| #77 | Inkling medium | Thinkingmachines | 3.0 | 8.0 | $0.383 | 0/1 | 4.48s |
| #251 | KAT-Coder-Air V2.5 low | Kwaipilot | 10.0 | 5.4 | $0.046 | 1/1 | 4.47s |
| #232 | Kimi K2.6 none | Moonshot AI | 10.0 | 5.7 | $0.233 | 1/1 | 4.46s |
| #74 | DeepSeek V4 Flash 0731 low | DeepSeek | 10.0 | 8.0 | $0.031 | 1/1 | 4.44s |
| #195 | GPT-5.6 Luna low | OpenAI | 10.0 | 6.2 | $0.051 | 1/1 | 4.43s |
| #207 | Qwen3.5 Plus 2026-04-20 none | Qwen | 10.0 | 6.1 | $0.122 | 1/1 | 4.42s |
| #127 | DeepSeek V4 Flash 0731 medium | DeepSeek | 10.0 | 7.3 | $0.046 | 1/1 | 4.41s |
| #42 | Gemini 3.6 Flash low | 10.0 | 8.7 | $0.251 | 1/1 | 4.40s | |
| #239 | Mimo V2 PRO none | Xiaomi | 10.0 | 5.6 | $0.045 | 1/1 | 4.39s |
| #322 | Qwen3.5-9B medium | Qwen | 10.0 | 3.8 | $0.062 | 1/1 | 4.31s |
| #44 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 1/1 | 4.17s |