टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं।
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #50 | Qwen3.8 Max low | Qwen | 10.0 | 8.6 | $0.702 | 1/1 | 8.06s |
| #51 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 1/1 | 13.3s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 10.0 | 8.5 | $0.448 | 1/1 | 13.8s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.5 | $0.574 | 1/1 | 15.3s |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 10.0 | 8.5 | $0.544 | 1/1 | 15.3s |
| #55 | Grok 4.5 medium | X AI | 10.0 | 8.5 | $2.042 | 1/1 | 6.57s |
| #56 | Muse Spark 1.2 low | Meta | 10.0 | 8.4 | $0.655 | 1/1 | 3.58s |
| #57 | Grok 4.6 medium | X AI | 10.0 | 8.4 | $1.713 | 1/1 | 12.8s |
| #58 | Grok 4.5 low | X AI | 10.0 | 8.4 | $0.945 | 1/1 | 5.83s |
| #60 | Qwen3.8 27B high | Qwen | 10.0 | 8.4 | ~$0.287 | 1/1 | 5.62s |
| #61 | Seed 2.1 Turbo medium | Bytedance Seed | 10.0 | 8.4 | $1.951 | 1/1 | 27.5s |
| #63 | DeepSeek V4.1 Flash max | DeepSeek | 10.0 | 8.3 | $1.073 | 1/1 | 9.49s |
| #65 | Claude Fable 5.1 medium | Anthropic | 10.0 | 8.3 | $2.909 | 1/1 | 13.0s |
| #66 | Gemini 2.5 Flash medium | 10.0 | 8.2 | $0.644 | 1/1 | 6.20s | |
| #67 | Muse Spark 1.3 low | Meta | 10.0 | 8.2 | $0.689 | 1/1 | 7.39s |