AI BENCHY Compare

OpenAI: gpt-oss-120b vs Laguna Xs.2

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-29

المقياس	gpt-oss-120b gpt-oss-120b medium الإصدار: 2025-08-05 متاح مجانًا	Laguna Xs.2 Laguna Xs.2 none الإصدار: 2026-04-28 متاح مجانًا

المقياس	gpt-oss-120b gpt-oss-120b medium الإصدار: 2025-08-05 متاح مجانًا	Laguna Xs.2 Laguna Xs.2 none الإصدار: 2026-04-28 متاح مجانًا
النتيجة	5.8	5.0
الترتيب	#88	#118
الموثوقية	غير متاح	9.9
الاتساق	7.2	10.0
اختبارات صحيحة
معدل النجاح لكل محاولة	51.9%	27.8%
اختبارات غير مستقرة	6	0
إجمالي مرات التشغيل	54	54
التكلفة لكل نتيجة	0.144	0.000
إجمالي التكلفة	$0.011	$0.000
??? ???????	$0.000 / 1M	$0.000 / 1M
??? ???????	$0.000 / 1M	$0.000 / 1M
رموز الإخراج	13,493	3,824
رموز الاستدلال	36,879	0
زمن الاستجابة (المتوسط)	16.08s	1.68s
زمن الاستجابة (الحد الأقصى)	50.92s	16.04s
زمن الاستجابة (الإجمالي)	176.88s	30.26s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	6.7	9.9	50.0%	0		10.21s	3,518	2,177
Laguna Xs.2	3.2	10.0	0.0%	0		743ms	933	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	4.3	1.1	66.7%	1		26.33s	228	2,549
Laguna Xs.2	2.5	10.0	0.0%	0		1.96s	866	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	10.0	10.0	100.0%	0		31.18s	694	5,072
Laguna Xs.2	3.0	10.0	0.0%	0		2.01s	521	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	6.4	5.9	66.7%	1		1.98s	241	1,114
Laguna Xs.2	10.0	10.0	100.0%	0		646ms	246	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	2.9	4.4	22.2%	2		50.92s	6,784	20,606
Laguna Xs.2	5.3	10.0	33.3%	0		371ms	33	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	4.3	10.0	0.0%	0		7.90s	107	387
Laguna Xs.2	5.0	10.0	0.0%	0		16.04s	200	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	9.9	10.0	100.0%	0		7.63s	126	1,799
Laguna Xs.2	6.5	10.0	50.0%	0		439ms	81	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	3.2	4.7	22.2%	2		11.80s	1,508	2,092
Laguna Xs.2	5.4	10.0	33.3%	0		688ms	552	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
gpt-oss-120b	9.8	10.0	100.0%	0		6.91s	287	1,083
Laguna Xs.2	3.0	10.0	0.0%	0		1.93s	392	0

مقارنة سريعة

تبديل زوج المقارنة

Kimi K2.6nonevsgpt-oss-120bmediumمتاح مجانًا gpt-oss-120bmediumمتاح مجانًاvsQwen3.5-27Bnone gpt-oss-120bmediumمتاح مجانًاvsQwen3.5 Plus 2026-04-20none gpt-oss-120bmediumمتاح مجانًاvsMiMo-V2.5-Pronone gpt-oss-120bmediumمتاح مجانًاvsQwen3.6 Flashnone gpt-oss-120bmediumمتاح مجانًاvsQwen3.5-122B-A10Bnone gpt-oss-120bmediumمتاح مجانًاvsMiMo-V2-Pronone DeepSeek V3.2nonevsgpt-oss-120bmediumمتاح مجانًا Nemotron 3 Nano Omni 30b A3b Reasoningmediumمتاح مجانًاvsLaguna Xs.2noneمتاح مجانًا gpt-oss-120bmediumمتاح مجانًاvsQwen3.6 27Bnone Elephant AlphamediumvsLaguna Xs.2noneمتاح مجانًا MiniMax M2.7mediumvsLaguna Xs.2noneمتاح مجانًا