AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY श्रेणी

टूल कॉलिंग रैंकिंग

देखें कि टूल कॉलिंग में कौन से AI मॉडल सबसे अच्छा प्रदर्शन करते हैं, कौन से भरोसेमंद बने रहते हैं और सबसे बड़े अंतर कहाँ दिखाई देते हैं। क्रमबद्ध करें: प्रतिक्रिया समय (औसत) ↓.

दिखाए गए मॉडल

8

औसत टूल कॉलिंग स्कोर

8.7

सर्वश्रेष्ठ मॉडल

Seed-2.0-Mini 10.0
रैंक मॉडल कंपनी टूल कॉलिंग स्कोर स्कोर सही परीक्षण प्रतिक्रिया समय (औसत)
#90 Qwen3.5-9B none Qwen 10.0 4.8 1/1 1.27s
#91 Mercury 2 none Inception 10.0 4.8 1/1 1.27s
#14 Gemma 4 31B medium Google 3.0 8.3 0/1 0ms
#33 GLM 5.1 medium Z.ai 3.0 7.8 0/1 0ms
#48 Gemma 4 31B none Google 3.0 6.9 0/1 0ms
#56 Grok 4.20 Multi Agent Beta medium X AI 3.0 6.4 0/1 0ms
#84 gpt-oss-120b none OpenAI 3.0 5.2 0/1 0ms
#98 LFM2-24B-A2B none Liquid 3.0 4.1 0/1 0ms

टूल कॉलिंग स्कोर के अनुसार शीर्ष मॉडल

टूल कॉलिंग स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल