AI BENCHY Compare

Elephant Alpha vs Z.ai: GLM 5.1

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-29

المقياس	Elephant Alpha Elephant Alpha medium الإصدار: 2026-04-14	GLM 5.1 GLM 5.1 none الإصدار: 2026-04-07

المقياس	Elephant Alpha Elephant Alpha medium الإصدار: 2026-04-14	GLM 5.1 GLM 5.1 none الإصدار: 2026-04-07
النتيجة	5.4	5.8
الترتيب	#127	#108
الموثوقية	غير متاح	10.0
الاتساق	9.6	8.4
اختبارات صحيحة
معدل النجاح لكل محاولة	33.3%	43.3%
اختبارات غير مستقرة	1	4
إجمالي مرات التشغيل	60	60
التكلفة لكل نتيجة	0.000	0.806
إجمالي التكلفة	$0.000	$0.057
سعر الإدخال	$0.000 / 1M	$0.980 / 1M
سعر الإخراج	$0.000 / 1M	$3.080 / 1M
رموز الإخراج	2,596	3,748
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	1.27s	4.20s
زمن الاستجابة (الحد الأقصى)	3.70s	32.57s
زمن الاستجابة (الإجمالي)	22.82s	83.95s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	6.6	10.0	50.0%	0		1.19s	815	0
GLM 5.1	4.0	6.3	25.0%	2		2.11s	305	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	4.0	6.7	16.7%	1		1.30s	365	0
GLM 5.1	4.3	9.5	0.0%	0		6.33s	519	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	3.0	10.0	0.0%	0		3.70s	562	0
GLM 5.1	2.8	2.1	33.3%	1		32.57s	2,129	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	6.5	10.0	50.0%	0		979ms	246	0
GLM 5.1	10.0	10.0	100.0%	0		1.08s	204	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	3.0	10.0	0.0%	0		925ms	24	0
GLM 5.1	2.9	7.2	11.1%	1		1.99s	24	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	4.3	10.0	0.0%	0		920ms	105	0
GLM 5.1	5.0	10.0	0.0%	0		790ms	39	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	9.8	10.0	100.0%	0		987ms	82	0
GLM 5.1	9.8	10.0	100.0%	0		1.98s	66	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	5.3	10.0	33.3%	0		868ms	166	0
GLM 5.1	7.7	10.0	66.7%	0		1.45s	151	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	3.0	10.0	0.0%	0		2.83s	231	0
GLM 5.1	10.0	10.0	100.0%	0		10.68s	300	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Elephant Alpha	0.0	0.0	0.0%	0		0ms	0	0
GLM 5.1	3.0	10.0	0.0%	0		2.34s	11	0

مقارنة سريعة

تبديل زوج المقارنة

Elephant AlphamediumvsQwen3.5-122B-A10Bnone Elephant AlphamediumvsGrok 4.20none gpt-oss-120bnoneمتاح مجانًاvsElephant Alphamedium Owl AlphamediumvsGLM 5.1none Elephant AlphamediumvsGLM 5 Turbonone CobuddymediumvsGLM 5.1none Kimi K2.5nonevsElephant Alphamedium gpt-oss-120bmediumمتاح مجانًاvsGLM 5.1none Nemotron 3 Supermediumمتاح مجانًاvsGLM 5.1none Ling-2.6-flashnonevsElephant Alphamedium Elephant AlphamediumvsQwen3.6 Flashnone Elephant AlphamediumvsMiMo-V2.5-Pronone