AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
Your ad here

إخفاقات AI BENCHY

إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: زمن الاستجابة (المتوسط) ↓.

النماذج المعروضة

6

إجمالي الإخفاقات

7

النموذج الأكثر تأثرًا

Kimi K2.5 1
الترتيب النموذج الشركة عدد لا توجد إجابة متوسط الدرجة اختبارات صحيحة زمن الاستجابة (المتوسط)
#28 Kimi K2.5 medium Moonshot AI 1 6.4 9/16 69.8s
#35 Qwen3.5-35B-A3B medium Qwen 1 5.5 8/16 43.9s
#52 GLM 4.7 Flash medium Z.ai 2 3.1 4/16 36.8s
#30 Grok 4.1 Fast medium X AI 1 6.2 9/16 26.3s
#14 GLM 5 medium Z.ai 1 7.4 11/16 16.2s
#27 GPT-5.2 medium OpenAI 1 6.5 10/16 15.3s

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل متوسط الدرجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)