AI BENCHY Compare

Xiaomi: MiMo-V2.5 vs Z.ai: GLM 5

الملخص

مقارنة benchmark بين MiMo-V2.5 و GLM 5: يتقدم MiMo-V2.5 في متوسط النتيجة بـ 6.7 مقابل 6.0. لدى GLM 5 تكلفة benchmark أقل عند $0.027 مقابل $0.063. GLM 5 أسرع عند 4.03s مقابل 27.11s، مع معدلات نجاح 69.8% مقابل 44.4%.

النموذج الموصى به: GLM 5 - Its score stays close to the best score here (6.0 vs 6.7), while costing about 2.4x less than MiMo-V2.5.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-18

المقياس	MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22	GLM 5 GLM 5 none الإصدار: 2026-02-12

المقياس	MiMo-V2.5 MiMo-V2.5 medium الإصدار: 2026-04-22	GLM 5 GLM 5 none الإصدار: 2026-02-12
النتيجة	6.7	6.0
الترتيب	#76	#101
الموثوقية	10.0	10.0
الاتساق	8.1	9.7
اختبارات صحيحة
معدل النجاح لكل محاولة	69.8%	44.4%
اختبارات غير مستقرة	5	1
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	2.966	0.263
إجمالي التكلفة	$0.063	$0.027
سعر الإدخال	$0.140 / 1M	$0.600 / 1M
سعر الإخراج	$0.280 / 1M	$1.920 / 1M
إجمالي رموز الإدخال	41,838	37,135
رموز الإخراج	2,827	1,989
رموز الاستدلال	198,898	0
زمن الاستجابة (المتوسط)	27.11s	4.03s
زمن الاستجابة (الحد الأقصى)	162.44s	11.07s
زمن الاستجابة (الإجمالي)	569.38s	56.37s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MiMo-V2.5

medium

التكلفة: $0.002
الوقت: 54.8s
الرموز: 5,247 tok

#101 GLM 5

none

التكلفة: $0.007
الوقت: 32.1s
الرموز: 2,023 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	10.0	10.0	100.0%	0		4.14s	621	281	1,739
GLM 5	4.8	10.0	25.0%	0		2.37s	510	275	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	6.2	4.7	66.7%	2		97.14s	7,422	557	81,977
GLM 5	4.0	7.8	11.1%	1		5.12s	7,256	428	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	10.0	10.0	100.0%	0		16.86s	15,060	363	7,609
GLM 5	3.0	10.0	0.0%	0		4.98s	12,812	406	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	2.7	5.7	16.7%	1		6.33s	7,746	306	5,714
GLM 5	10.0	10.0	100.0%	0		5.78s	7,107	203	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	5.3	10.0	33.3%	0		34.53s	735	507	49,478
GLM 5	3.0	10.0	0.0%	0		2.24s	643	19	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	5.4	2.5	66.7%	1		5.37s	492	121	418
GLM 5	10.0	10.0	100.0%	0		3.27s	477	103	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	9.9	10.0	100.0%	0		1.80s	672	88	801
GLM 5	10.0	10.0	100.0%	0		1.48s	636	61	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	8.2	7.2	88.9%	1		20.25s	660	279	33,254
GLM 5	7.7	10.0	66.7%	0		1.91s	609	261	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	10.0	10.0	100.0%	0		7.29s	8,220	303	2,424
GLM 5	10.0	10.0	100.0%	0		11.07s	6,899	220	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
MiMo-V2.5	3.0	10.0	0.0%	0		51.29s	210	22	15,484
GLM 5	3.0	10.0	0.0%	0		3.62s	186	13	0

مقارنة سريعة

تبديل زوج المقارنة

Gemini 3.5 FlashminimalvsMiMo-V2.5medium North Mini Codemediumمتاح مجانًاvsGLM 5none Qwen3.7 MaxnonevsMiMo-V2.5medium Gemini 3.1 Flash LiteminimalvsGLM 5none Gemini 3 Flash PreviewnonevsMiMo-V2.5medium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5medium Gemini 3.5 FlashnonevsMiMo-V2.5medium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5medium Gemini 3.1 Flash LitelowvsMiMo-V2.5medium Qwen3.5-35B-A3BmediumvsGLM 5none Gemma 4 31Bmediumمتاح مجانًاvsGLM 5none Nemotron 3 Supermediumمتاح مجانًاvsGLM 5none