AI BENCHY Compare

Qwen3.6 Plus Preview vs Xiaomi: MiMo-V2.5-Pro

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-22

المقياس	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium الإصدار: 2026-03-30 متاح مجانًا	MiMo-V2.5-Pro MiMo-V2.5-Pro medium الإصدار: 2026-04-22

المقياس	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium الإصدار: 2026-03-30 متاح مجانًا	MiMo-V2.5-Pro MiMo-V2.5-Pro medium الإصدار: 2026-04-22
النتيجة	8.5	8.1
الترتيب	#9	#23
الاتساق	10.0	8.8
اختبارات صحيحة
معدل النجاح لكل محاولة	76.5%	75.9%
اختبارات غير مستقرة	0	3
إجمالي مرات التشغيل	49	54
التكلفة لكل نتيجة	0.000	1.674
إجمالي التكلفة	$0.000	$0.201
??? ???????	$0.000 / 1M	$1.000 / 1M
??? ???????	$0.000 / 1M	$3.000 / 1M
رموز الإخراج	1,756	2,735
رموز الاستدلال	77,213	52,571
زمن الاستجابة (المتوسط)	13.94s	16.17s
زمن الاستجابة (الحد الأقصى)	43.55s	84.22s
زمن الاستجابة (الإجمالي)	237.01s	291.09s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		9.90s	207	7,557
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		2.95s	273	1,363

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		34.95s	452	13,073
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		53.36s	348	11,870

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		14.95s	270	10,706
MiMo-V2.5-Pro	7.3	5.8	83.3%	1		18.81s	260	8,383

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	3.0	10.0	0.0%	0		22.08s	49	26,895
MiMo-V2.5-Pro	5.3	10.0	33.3%	0		37.87s	275	17,023

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	5.1	10.0	0.0%	0		27.05s	111	5,232
MiMo-V2.5-Pro	5.1	3.3	33.3%	1		4.27s	150	549

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		7.54s	102	5,552
MiMo-V2.5-Pro	9.9	10.0	100.0%	0		2.77s	82	803

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		6.11s	298	6,868
MiMo-V2.5-Pro	6.7	7.9	55.6%	1		5.16s	493	2,187

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		5.87s	267	1,330
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		16.87s	311	2,908

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Qwen3.6 Plus Preview	-	-	-	-	-	-	-	-
MiMo-V2.5-Pro	10.0	10.0	100.0%	0		32.58s	543	7,485

مقارنة سريعة

تبديل زوج المقارنة

Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsMiMo-V2.5-Promedium GPT-5.2 ChatnonevsMiMo-V2.5-Promedium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5-Promedium Gemini 3 Flash PreviewnonevsQwen3.6 Plus Previewmediumمتاح مجانًا Gemini 3 Flash PreviewlowvsQwen3.6 Plus Previewmediumمتاح مجانًا Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 Plus Previewmediumمتاح مجانًا GPT-5.3 ChatnonevsMiMo-V2.5-Promedium GPT-5.2 ChatnonevsQwen3.6 Plus Previewmediumمتاح مجانًا Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 Plus Previewmediumمتاح مجانًا Claude Sonnet 4.6nonevsMiMo-V2.5-Promedium Gemini 3 Flash PreviewlowvsMiMo-V2.5-Promedium