AI BENCHY Compare

OpenAI: gpt-oss-120b vs Xiaomi: MiMo-V2-Pro

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس	gpt-oss-120b gpt-oss-120b none الإصدار: 2025-08-05 متاح مجانًا	MiMo-V2-Pro MiMo-V2-Pro none الإصدار: 2026-03-18

المقياس	gpt-oss-120b gpt-oss-120b none الإصدار: 2025-08-05 متاح مجانًا	MiMo-V2-Pro MiMo-V2-Pro none الإصدار: 2026-03-18
النتيجة	5.2	5.7
الترتيب	#129	#107
الموثوقية	10.0	10.0
الاتساق	8.7	8.7
اختبارات صحيحة
معدل النجاح لكل محاولة	36.8%	43.3%
اختبارات غير مستقرة	3	3
إجمالي مرات التشغيل	57	60
التكلفة لكل نتيجة	0.201	0.664
إجمالي التكلفة	$0.011	$0.047
??? ???????	$0.000 / 1M	$1.000 / 1M
??? ???????	$0.000 / 1M	$3.000 / 1M
رموز الإخراج	51,505	2,371
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	21.86s	2.31s
زمن الاستجابة (الحد الأقصى)	113.71s	6.58s
زمن الاستجابة (الإجمالي)	349.78s	46.17s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	6.5	10.0	50.0%	0		32.84s	8,676	0
MiMo-V2-Pro	3.5	8.0	16.7%	1		1.80s	315	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	4.3	1.1	66.7%	1		9.57s	3,232	0
MiMo-V2-Pro	6.8	10.0	50.0%	0		2.65s	626	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	3.0	10.0	0.0%	0		0ms	0	0
MiMo-V2-Pro	3.0	10.0	0.0%	0		6.58s	333	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	6.5	10.0	50.0%	0		7.12s	598	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		1.39s	249	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	3.0	10.0	0.0%	0		34.98s	29,483	0
MiMo-V2-Pro	5.3	7.2	44.4%	1		1.78s	26	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	4.8	10.0	0.0%	0		10.79s	615	0
MiMo-V2-Pro	4.3	9.9	0.0%	0		2.44s	125	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	9.8	10.0	100.0%	0		5.10s	1,982	0
MiMo-V2-Pro	6.5	10.0	50.0%	0		2.51s	69	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	4.4	4.5	44.5%	2		9.51s	3,781	0
MiMo-V2-Pro	6.0	7.1	55.6%	1		1.83s	327	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	3.0	10.0	0.0%	0		0ms	0	0
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.39s	277	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	3.0	10.0	0.0%	0		47.29s	3,138	0
MiMo-V2-Pro	3.0	10.0	0.0%	0		1.63s	24	0

مقارنة سريعة

تبديل زوج المقارنة

Cobuddymediumمتاح مجانًاvsMiMo-V2-Pronone gpt-oss-120bmediumمتاح مجانًاvsMiMo-V2-Pronone Owl AlphamediumvsMiMo-V2-Pronone MiniMax M2.7mediumvsgpt-oss-120bnoneمتاح مجانًا gpt-oss-120bnoneمتاح مجانًاvsElephant Alphamedium Mistral Small 4mediumvsgpt-oss-120bnoneمتاح مجانًا Nemotron 3 Supermediumمتاح مجانًاvsMiMo-V2-Pronone MiniMax M2.5mediumمتاح مجانًاvsgpt-oss-120bnoneمتاح مجانًا MiniMax M2.5mediumمتاح مجانًاvsMiMo-V2-Pronone Mistral Small 4mediumvsMiMo-V2-Pronone Elephant AlphamediumvsMiMo-V2-Pronone GPT-5 NanomediumvsMiMo-V2-Pronone