टूल कॉलिंग रैंकिंग
देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: कुल लागत ↑.
330/330
मॉडल फ़िल्टर करें
मौजूदा खोज और फ़िल्टर से कोई मॉडल मेल नहीं खाता।
| रैंक | मॉडल | कंपनी | टूल कॉलिंग स्कोर | स्कोर | कुल लागत | सही परीक्षण | प्रतिक्रिया समय (औसत) |
|---|---|---|---|---|---|---|---|
| #262 | Qwen3.6 35B A3B none | Qwen | 3.0 | 5.3 | $0.051 | 0/1 | 0ms |
| #195 | GPT-5.6 Luna low | OpenAI | 10.0 | 6.2 | $0.051 | 1/1 | 4.43s |
| #183 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 1/1 | 3.39s | |
| #236 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #92 | Qwen3.7 Flash high | Qwen | 10.0 | 7.8 | $0.052 | 1/1 | 5.72s |
| #250 | Laguna S 2.1 medium | Poolside | 10.0 | 5.4 | $0.053 | 1/1 | 2.24s |
| #257 | Inkling Small none | Thinkingmachines | 3.0 | 5.3 | $0.054 | 0/1 | 2.31s |
| #279 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 1/1 | 11.8s |
| #227 | Nemotron 3 Super medium | NVIDIA | 10.0 | 5.7 | $0.054 | 1/1 | 39.7s |
| #229 | Inkling Small low | Thinkingmachines | 3.0 | 5.7 | $0.055 | 0/1 | 2.21s |
| #310 | Grok 4.20 none | X AI | 10.0 | 4.1 | $0.057 | 1/1 | 4.63s |
| #89 | Qwen3.8 27B medium | Qwen | 3.0 | 7.8 | ~$0.058 | 0/1 | 0ms |
| #75 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.0 | $0.058 | 1/1 | 5.42s |
| #173 | Qwen3.5-27B none | Qwen | 10.0 | 6.6 | $0.058 | 1/1 | 3.54s |
| #205 | Qwen3.6 Flash none | Qwen | 10.0 | 6.1 | $0.062 | 1/1 | 2.49s |