AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
Your ad here

إخفاقات AI BENCHY

إخفاقات لا توجد إجابة

اكتشف أي نماذج الذكاء الاصطناعي تواجه لا توجد إجابة أكثر من غيرها، حتى ترى مخاطر الاعتمادية قبل الاختيار. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.

النماذج المعروضة

6

إجمالي الإخفاقات

7

النموذج الأكثر تأثرًا

GPT-5.2 1
الترتيب النموذج الشركة عدد لا توجد إجابة متوسط الدرجة اختبارات صحيحة زمن الاستجابة (المتوسط)
#27 GPT-5.2 medium OpenAI 1 6.5 10/16 15.3s
#14 GLM 5 medium Z.ai 1 7.4 11/16 16.2s
#30 Grok 4.1 Fast medium X AI 1 6.2 9/16 26.3s
#52 GLM 4.7 Flash medium Z.ai 2 3.1 4/16 36.8s
#35 Qwen3.5-35B-A3B medium Qwen 1 5.5 8/16 43.9s
#28 Kimi K2.5 medium Moonshot AI 1 6.4 9/16 69.8s

أفضل النماذج حسب عدد لا توجد إجابة

عدد لا توجد إجابة مقابل متوسط الدرجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)