AI BENCHY
قارن الرسوم البيانية المنهجية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

إخفاقات الفئات في AI BENCHY

خاص بالمجال
انتهت المهلة

اكتشف أي نماذج الذكاء الاصطناعي هي الأكثر عرضة لظهور انتهت المهلة في خاص بالمجال، حتى ترصد نقاط الضعف بسرعة أكبر. الترتيب حسب: زمن الاستجابة (المتوسط) ↑.

النماذج المعروضة

14

إجمالي الإخفاقات

17

النموذج الأكثر تأثرًا

Claude Sonnet 4.6 1
الترتيب النموذج الشركة عدد انتهت المهلة درجة الفئة اختبارات صحيحة زمن الاستجابة (المتوسط)
#11 Claude Sonnet 4.6 medium Anthropic 1 10.0 0/3 0ms
#14 GLM 5 medium Z.ai 1 10.0 0/3 0ms
#23 Seed-2.0-Mini medium Bytedance Seed 3 10.0 0/3 0ms
#4 Qwen3.5 Plus 2026-02-15 medium Qwen 1 4.0 1/3 17.5s
#18 DeepSeek V3.2 medium DeepSeek 1 4.0 1/3 39.3s
#32 GPT-5 Mini medium OpenAI 1 10.0 0/3 44.6s
#27 GPT-5.2 medium OpenAI 1 4.0 1/3 77.8s
#7 Qwen3.5-27B medium Qwen 1 4.0 1/3 79.5s
#35 Qwen3.5-35B-A3B medium Qwen 2 10.0 0/3 88.3s
#30 Grok 4.1 Fast medium X AI 1 4.0 1/3 121.8s
#28 Kimi K2.5 medium Moonshot AI 1 10.0 0/3 137.3s
#24 Qwen3.5-Flash medium Qwen 1 4.0 1/3 146.5s
#34 GPT-5 Nano medium OpenAI 1 4.0 1/3 204.0s
#43 MiniMax M2.5 medium Minimax 1 10.0 0/3 237.3s

أفضل النماذج حسب عدد انتهت المهلة

عدد انتهت المهلة مقابل متوسط الدرجة

أفضل النماذج حسب زمن الاستجابة (المتوسط)

أفضل النماذج حسب التكلفة المهدرة التقديرية