टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↓.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #248 | DeepSeek V4 Flash 0423 none | DeepSeek | 10.0 | 5.4 | $0.040 | 1/1 | 77.9s |
| #308 | Granite 4.2 8B none | IBM Granite | 10.0 | 4.3 | $0.037 | 1/1 | 1.39s |
| #124 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.034 | 1/1 | 15.6s |
| #300 | Qwen3 Coder Next medium | Qwen | 10.0 | 4.6 | $0.034 | 1/1 | 2.64s |
| #325 | gpt-oss-120b none | OpenAI | 3.0 | 3.7 | $0.033 | 0/1 | 0ms |
| #296 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 1/1 | 6.31s |
| #139 | Mercury 2.5 high | Inception | 10.0 | 7.1 | $0.031 | 1/1 | 3.06s |
| #74 | DeepSeek V4 Flash 0731 low | DeepSeek | 10.0 | 8.0 | $0.031 | 1/1 | 4.44s |
| #298 | Mercury 2 none | Inception | 10.0 | 4.7 | $0.030 | 1/1 | 1.27s |
| #178 | Mercury 2.5 Preview high | Inception | 3.0 | 6.6 | $0.030 | 0/1 | 2.25s |
| #252 | GPT-5.6 Luna none | OpenAI | 10.0 | 5.4 | $0.029 | 1/1 | 2.80s |
| #228 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 1/1 | 11.1s |
| #286 | Ring-2.6-1T none | Inclusionai | 3.0 | 4.8 | $0.026 | 0/1 | 0ms |
| #270 | Qwen3 Coder Next none | Qwen | 10.0 | 5.1 | $0.026 | 1/1 | 2.47s |
| #272 | MiMo-V2.5 none | Xiaomi | 10.0 | 5.1 | $0.025 | 1/1 | 2.43s |