AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs Z.ai: GLM 5.1

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-20

المقياس	Kimi K2.6 Kimi K2.6 medium الإصدار: 2026-04-20	GLM 5.1 GLM 5.1 medium الإصدار: 2026-04-07

المقياس	Kimi K2.6 Kimi K2.6 medium الإصدار: 2026-04-20	GLM 5.1 GLM 5.1 medium الإصدار: 2026-04-07
النتيجة	7.7	7.8
الترتيب	#34	#33
الاتساق	8.3	8.6
اختبارات صحيحة
معدل النجاح لكل محاولة	74.1%	75.9%
اختبارات غير مستقرة	4	3
إجمالي مرات التشغيل	54	54
التكلفة لكل نتيجة	6.563	1.674
إجمالي التكلفة	$0.722	$0.201
??? ???????	$0.950 / 1M	$1.050 / 1M
??? ???????	$4.000 / 1M	$3.500 / 1M
رموز الإخراج	80,759	8,005
رموز الاستدلال	179,814	49,090
زمن الاستجابة (المتوسط)	45.20s	24.13s
زمن الاستجابة (الحد الأقصى)	215.85s	118.52s
زمن الاستجابة (الإجمالي)	768.37s	410.25s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	7.0	8.0	66.7%	1		11.59s	7,115	8,934
GLM 5.1	10.0	10.0	100.0%	0		8.31s	401	5,122

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		106.96s	3,236	18,817
GLM 5.1	4.7	1.6	66.7%	1		118.52s	1,339	13,777

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		40.96s	711	13,876
GLM 5.1	9.5	10.0	100.0%	0		43.11s	327	4,206

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		20.38s	316	11,305
GLM 5.1	10.0	10.0	100.0%	0		9.33s	991	4,552

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	5.3	7.2	44.4%	1		202.38s	47,035	98,262
GLM 5.1	5.3	10.0	33.3%	0		29.77s	969	11,314

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		17.83s	3,981	4,472
GLM 5.1	10.0	10.0	100.0%	0		20.95s	2,875	2,875

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		12.53s	3,977	5,269
GLM 5.1	6.4	5.8	66.7%	1		7.47s	204	1,617

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	5.0	5.2	44.5%	2		25.59s	14,140	17,868
GLM 5.1	8.2	7.2	88.9%	1		23.85s	899	5,627

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		8.92s	248	1,011
GLM 5.1	3.0	10.0	0.0%	0		0ms	0	0

مقارنة سريعة

تبديل زوج المقارنة

Kimi K2.6mediumvsGPT-5.3 Chatnone Gemini 3.1 Flash Lite PreviewnonevsGLM 5.1medium GPT-5.2 ChatnonevsGLM 5.1medium GPT-5.3 ChatnonevsGLM 5.1medium Gemini 3.1 Flash Lite PreviewnonevsKimi K2.6medium Kimi K2.6mediumvsGPT-5.2 Chatnone Claude Sonnet 4.6nonevsKimi K2.6medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5.1medium Gemini 3 Flash PreviewnonevsGLM 5.1medium Claude Sonnet 4.6nonevsGLM 5.1medium Gemini 3.1 Flash Lite PreviewlowvsKimi K2.6medium Gemini 3 Flash PreviewnonevsKimi K2.6medium