AI BENCHY Compare

Owl Alpha vs Owl Alpha

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس	Owl Alpha Owl Alpha medium الإصدار: 2026-04-30	Owl Alpha Owl Alpha none الإصدار: 2026-04-30

المقياس	Owl Alpha Owl Alpha medium الإصدار: 2026-04-30	Owl Alpha Owl Alpha none الإصدار: 2026-04-30
النتيجة	5.8	5.7
الترتيب	#100	#106
الموثوقية	9.9	10.0
الاتساق	9.6	9.2
اختبارات صحيحة
معدل النجاح لكل محاولة	41.7%	41.7%
اختبارات غير مستقرة	1	2
إجمالي مرات التشغيل	60	60
التكلفة لكل نتيجة	0.000	0.000
إجمالي التكلفة	$0.000	$0.000
??? ???????	$0.000 / 1M	$0.000 / 1M
??? ???????	$0.000 / 1M	$0.000 / 1M
رموز الإخراج	2,965	4,864
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	11.59s	8.84s
زمن الاستجابة (الحد الأقصى)	58.63s	47.10s
زمن الاستجابة (الإجمالي)	231.84s	176.83s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	4.8	10.0	25.0%	0		3.97s	87	0
Owl Alpha	3.4	7.9	16.7%	1		2.78s	57	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	6.6	10.0	50.0%	0		19.08s	1,754	0
Owl Alpha	7.0	9.9	50.0%	0		39.68s	3,629	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	3.0	10.0	0.0%	0		10.01s	315	0
Owl Alpha	3.0	10.0	0.0%	0		21.74s	315	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	10.0	10.0	100.0%	0		21.64s	246	0
Owl Alpha	10.0	10.0	100.0%	0		3.60s	246	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	5.3	10.0	33.3%	0		8.58s	28	0
Owl Alpha	5.3	10.0	33.3%	0		3.00s	27	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	4.3	10.0	0.0%	0		58.63s	98	0
Owl Alpha	4.3	10.0	0.0%	0		4.61s	80	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	6.3	10.0	50.0%	0		9.59s	57	0
Owl Alpha	6.4	10.0	50.0%	0		2.63s	63	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	5.3	7.2	44.4%	1		3.44s	135	0
Owl Alpha	5.9	7.2	55.6%	1		4.43s	202	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	10.0	10.0	100.0%	0		8.26s	228	0
Owl Alpha	10.0	10.0	100.0%	0		22.78s	231	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Owl Alpha	3.0	10.0	0.0%	0		2.38s	17	0
Owl Alpha	3.0	10.0	0.0%	0		2.50s	14	0

مقارنة سريعة

تبديل زوج المقارنة

Cobuddymediumمتاح مجانًاvsOwl Alphanone Seed-2.0-LitenonevsOwl Alphamedium Owl AlphamediumvsQwen3.5 Plus 2026-04-20none Owl AlphamediumvsQwen3.5-35B-A3Bnone Owl AlphamediumvsGLM 5V Turbonone Owl AlphamediumvsQwen3.5-27Bnone Owl AlphamediumvsQwen3.6 27Bnone Owl AlphamediumvsQwen3.5-Flashnone Owl AlphamediumvsMiMo-V2-Pronone gpt-oss-120bmediumمتاح مجانًاvsOwl Alphanone Nemotron 3 Supermediumمتاح مجانًاvsOwl Alphanone DeepSeek V4 PrononevsOwl Alphamedium