टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #249 | DeepSeek V4.1 Flash none | DeepSeek | 10.0 | 5.4 | $0.370 | 1/1 | 3.76s |
| #250 | Laguna S 2.1 medium | Poolside | 10.0 | 5.4 | $0.053 | 1/1 | 2.24s |
| #251 | KAT-Coder-Air V2.5 low | Kwaipilot | 10.0 | 5.4 | $0.046 | 1/1 | 4.47s |
| #252 | GPT-5.6 Luna none | OpenAI | 10.0 | 5.4 | $0.029 | 1/1 | 2.80s |
| #253 | MiMo-V2.5-Pro none | Xiaomi | 10.0 | 5.4 | $0.068 | 1/1 | 3.30s |
| #254 | Kimi K2.5 none | Moonshot AI | 10.0 | 5.4 | $0.101 | 1/1 | 14.0s |
| #256 | Laguna S 2.1 high | Poolside | 10.0 | 5.4 | $0.114 | 1/1 | 2.69s |
| #258 | Laguna XS 2.1 none | Poolside | 10.0 | 5.3 | $0.008 | 1/1 | 1.36s |
| #259 | Seed-2.0-Code none | Bytedance Seed | 10.0 | 5.3 | $0.151 | 1/1 | 48.8s |
| #261 | Gemini 3.1 Flash Lite Preview high | 10.0 | 5.3 | $2.310 | 1/1 | 7.73s | |
| #263 | Dots 3 Note Preview none | Dots Studio | 10.0 | 5.2 | $0.000 | 1/1 | 4.04s |
| #265 | Granite 4.2 8B medium | IBM Granite | 10.0 | 5.2 | $0.008 | 1/1 | 2.28s |
| #266 | Nemotron 3.5 Lightning medium | NVIDIA | 10.0 | 5.1 | $0.156 | 1/1 | 4.92s |
| #267 | Mistral Small 4 none | Mistral | 10.0 | 5.1 | $0.022 | 1/1 | 1.40s |
| #268 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |