AI BENCHY Compare
xAI: Grok 4.20 vs Z.ai: GLM 5
تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-10
| المقياس | Grok 4.20 Grok 4.20 medium | GLM 5 GLM 5 none |
|---|---|---|
| النتيجة | 6.9 | 6.5 |
| الترتيب | #68 | #80 |
| الموثوقية | 10.0 | 10.0 |
| الاتساق | 8.3 | 9.7 |
| اختبارات صحيحة | ||
| معدل النجاح لكل محاولة | 63.2% | 49.1% |
| اختبارات غير مستقرة | 4 | 1 |
| إجمالي مرات التشغيل | 57 | 57 |
| التكلفة لكل نتيجة | 7.559 | 0.219 |
| إجمالي التكلفة | $0.756 | $0.020 |
| ??? ??????? | $1.250 / 1M | $0.600 / 1M |
| ??? ??????? | $2.500 / 1M | $1.920 / 1M |
| رموز الإخراج | 1,784 | 1,972 |
| رموز الاستدلال | 128,233 | 0 |
| زمن الاستجابة (المتوسط) | 14.53s | 4.18s |
| زمن الاستجابة (الحد الأقصى) | 63.48s | 11.07s |
| زمن الاستجابة (الإجمالي) | 276.06s | 50.12s |
الدرجة مقابل التكلفة الإجمالية
زمن الاستجابة (المتوسط)
النتيجة vs زمن الاستجابة (المتوسط)
إجمالي رموز الإخراج
النتيجة vs إجمالي رموز الإخراج
تفصيل الفئات
مقارنة سريعة
تبديل زوج المقارنة
DeepSeek V4 ProhighvsGrok 4.20mediumGrok 4.1 FastmediumvsGLM 5noneGemma 4 31Bnoneمتاح مجانًاvsGrok 4.20mediumGemini 3.1 Flash LiteminimalvsGrok 4.20mediumGPT-5.5nonevsGrok 4.20mediumMercury 2mediumvsGLM 5noneGemini 3.1 Flash LitenonevsGrok 4.20mediumGPT-5 NanomediumvsGLM 5noneQwen3.5 Plus 2026-02-15nonevsGrok 4.20mediumClaude Sonnet 4.6nonevsGrok 4.20mediumQwen3.6 27BmediumvsGLM 5noneKimi K2.5mediumvsGLM 5none