टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: सही परीक्षण ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #254 | Kimi K2.5 none | Moonshot AI | 10.0 | 5.4 | $0.101 | 1/1 | 14.0s |
| #255 | DeepSeek V4 Flash 0731 none | DeepSeek | 9.5 | 5.4 | $0.009 | 1/1 | 4.61s |
| #256 | Laguna S 2.1 high | Poolside | 10.0 | 5.4 | $0.114 | 1/1 | 2.69s |
| #258 | Laguna XS 2.1 none | Poolside | 10.0 | 5.3 | $0.008 | 1/1 | 1.36s |
| #259 | Seed-2.0-Code none | Bytedance Seed | 10.0 | 5.3 | $0.151 | 1/1 | 48.8s |
| #261 | Gemini 3.1 Flash Lite Preview high | 10.0 | 5.3 | $2.310 | 1/1 | 7.73s | |
| #263 | Dots 3 Note Preview none | Dots Studio | 10.0 | 5.2 | $0.000 | 1/1 | 4.04s |
| #265 | Granite 4.2 8B medium | IBM Granite | 10.0 | 5.2 | $0.008 | 1/1 | 2.28s |
| #266 | Nemotron 3.5 Lightning medium | NVIDIA | 10.0 | 5.1 | $0.156 | 1/1 | 4.92s |
| #267 | Mistral Small 4 none | Mistral | 10.0 | 5.1 | $0.022 | 1/1 | 1.40s |
| #268 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |
| #269 | Granite 4.2 8B low | IBM Granite | 10.0 | 5.1 | $0.012 | 1/1 | 2.23s |
| #270 | Qwen3 Coder Next none | Qwen | 10.0 | 5.1 | $0.026 | 1/1 | 2.47s |
| #271 | Mercury 2.5 low | Inception | 9.8 | 5.1 | $0.011 | 1/1 | 2.72s |
| #272 | MiMo-V2.5 none | Xiaomi | 10.0 | 5.1 | $0.025 | 1/1 | 2.43s |