टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: मेट्रिक ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #184 | Qwen3.6 Max Preview none | Qwen | 10.0 | 6.4 | $0.228 | 1/1 | 5.27s |
| #185 | Dots 3 Note Preview low | Dots Studio | 10.0 | 6.4 | $0.000 | 1/1 | 7.36s |
| #186 | Dots 3 Note Preview high | Dots Studio | 10.0 | 6.4 | $0.000 | 1/1 | 6.96s |
| #187 | LongCat 2.0 none | Meituan | 10.0 | 6.4 | $0.044 | 1/1 | 6.64s |
| #188 | MiMo-V2.5 medium | Xiaomi | 10.0 | 6.4 | $0.104 | 1/1 | 7.29s |
| #189 | Ling-3.0-flash high | Inclusionai | 10.0 | 6.4 | $0.021 | 1/1 | 6.47s |
| #190 | Ring-2.6-1T medium | Inclusionai | 10.0 | 6.4 | $0.102 | 1/1 | 104.4s |
| #191 | Mimo V2 PRO medium | Xiaomi | 10.0 | 6.3 | $0.333 | 1/1 | 8.19s |
| #192 | MiMo-V2-Flash medium | Xiaomi | 10.0 | 6.3 | $0.043 | 1/1 | 27.8s |
| #193 | Seed-2.0-Lite none | Bytedance Seed | 10.0 | 6.2 | $0.066 | 1/1 | 3.94s |
| #195 | GPT-5.6 Luna low | OpenAI | 10.0 | 6.2 | $0.051 | 1/1 | 4.43s |
| #196 | Claude Sonnet 5 none | Anthropic | 10.0 | 6.1 | $0.548 | 1/1 | 6.80s |
| #197 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #198 | Qwen3.5-35B-A3B medium | Qwen | 10.0 | 6.1 | $1.172 | 1/1 | 4.65s |
| #200 | Qwen3.7 Flash none | Qwen | 10.0 | 6.1 | $0.019 | 1/1 | 2.80s |