AI BENCHY
Your ad here

إخفاقات AI BENCHY

إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار.

النماذج المعروضة

7

إجمالي الإخفاقات

8

النموذج الأكثر تأثرًا

GLM 4.7 Flash 2
الترتيب النموذج الشركة عدد لا توجد إجابة النتيجة اختبارات صحيحة زمن الاستجابة (المتوسط)
#93 GLM 4.7 Flash medium Z.ai 2 4.6 4/18 32.3s
#13 GLM 5 medium Z.ai 1 8.4 13/18 23.3s
#35 MiMo-V2-Omni medium Xiaomi 1 7.7 11/18 16.8s
#40 GPT-5.2 medium OpenAI 1 7.5 11/18 14.0s
#43 Qwen3.5-35B-A3B medium Qwen 1 7.4 10/18 44.5s
#46 Kimi K2.5 medium Moonshot AI 1 7.0 9/18 72.4s
#52 Grok 4.1 Fast medium X AI 1 6.7 9/18 23.9s

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل النتيجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)