AI BENCHY
Your ad here

إخفاقات AI BENCHY

إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: اختبارات صحيحة ↑.

النماذج المعروضة

7

إجمالي الإخفاقات

8

النموذج الأكثر تأثرًا

GLM 4.7 Flash 2
الترتيب النموذج الشركة عدد لا توجد إجابة النتيجة اختبارات صحيحة زمن الاستجابة (المتوسط)
#93 GLM 4.7 Flash medium Z.ai 2 4.6 4/18 32.3s
#46 Kimi K2.5 medium Moonshot AI 1 7.0 9/18 72.4s
#52 Grok 4.1 Fast medium X AI 1 6.7 9/18 23.9s
#43 Qwen3.5-35B-A3B medium Qwen 1 7.4 10/18 44.5s
#35 MiMo-V2-Omni medium Xiaomi 1 7.7 11/18 16.8s
#40 GPT-5.2 medium OpenAI 1 7.5 11/18 14.0s
#13 GLM 5 medium Z.ai 1 8.4 13/18 23.3s

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل النتيجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)