AI BENCHY
Advertise here

AI BENCHY श्रेणी विफलताएँ

निर्देश पालन: API त्रुटि

निर्देश पालन
API त्रुटि

देखें कि निर्देश पालन में किन AI मॉडलों में API त्रुटि आने की सबसे अधिक संभावना है, ताकि आप कमजोरियाँ जल्दी पहचान सकें। क्रमबद्ध करें: सही परीक्षण ↓.

दिखाए गए मॉडल

1

कुल विफलताएँ

1

सबसे अधिक प्रभावित मॉडल

Qwen3.6 Plus Preview 1

API त्रुटि संख्या के अनुसार शीर्ष मॉडल

API त्रुटि संख्या बनाम स्कोर

प्रतिक्रिया समय (औसत) के अनुसार शीर्ष मॉडल

अनुमानित व्यर्थ लागत के अनुसार शीर्ष मॉडल