टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #253 | MiMo-V2.5-Pro none | Xiaomi | 10.0 | 5.4 | $0.068 | 1/1 | 3.30s |
| #179 | Qwen3.5 Plus 2026-02-15 none | Qwen | 10.0 | 6.6 | $0.073 | 1/1 | 3.33s |
| #162 | Mercury 2.5 medium | Inception | 10.0 | 6.8 | $0.022 | 1/1 | 3.35s |
| #163 | Gemini 3 Flash Preview none | 10.0 | 6.8 | $0.085 | 1/1 | 3.35s | |
| #183 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 1/1 | 3.39s | |
| #311 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #288 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #268 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |
| #197 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #126 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 1/1 | 3.54s |
| #173 | Qwen3.5-27B none | Qwen | 10.0 | 6.6 | $0.058 | 1/1 | 3.54s |
| #56 | Muse Spark 1.2 low | Meta | 10.0 | 8.4 | $0.655 | 1/1 | 3.58s |
| #275 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #215 | Qwen3.5-Flash none | Qwen | 10.0 | 6.0 | $0.073 | 1/1 | 3.67s |
| #141 | GPT-5.6 Sol none | OpenAI | 10.0 | 7.0 | $0.201 | 1/1 | 3.70s |