AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
Your ad here

إخفاقات AI BENCHY

إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: اختبارات صحيحة ↓.

النماذج المعروضة

6

إجمالي الإخفاقات

7

النموذج الأكثر تأثرًا

GLM 5 1
الترتيب النموذج الشركة عدد لا توجد إجابة متوسط الدرجة اختبارات صحيحة زمن الاستجابة (المتوسط)
#14 GLM 5 medium Z.ai 1 7.4 11/16 16.2s
#27 GPT-5.2 medium OpenAI 1 6.5 10/16 15.3s
#28 Kimi K2.5 medium Moonshot AI 1 6.4 9/16 69.8s
#30 Grok 4.1 Fast medium X AI 1 6.2 9/16 26.3s
#35 Qwen3.5-35B-A3B medium Qwen 1 5.5 8/16 43.9s
#52 GLM 4.7 Flash medium Z.ai 2 3.1 4/16 36.8s

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل متوسط الدرجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)