AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs Elephant Alpha

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-04

المقياس	Kimi K2.6 Kimi K2.6 none الإصدار: 2026-04-20 متاح مجانًا	Elephant Alpha Elephant Alpha medium الإصدار: 2026-04-14

المقياس	Kimi K2.6 Kimi K2.6 none الإصدار: 2026-04-20 متاح مجانًا	Elephant Alpha Elephant Alpha medium الإصدار: 2026-04-14
النتيجة	5.5	5.1
الترتيب	#124	#136
الموثوقية	10.0	غير متاح
الاتساق	9.2	9.7
اختبارات صحيحة
معدل النجاح لكل محاولة	36.5%	30.2%
اختبارات غير مستقرة	2	1
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	1.267	0.000
إجمالي التكلفة	$0.079	$0.000
سعر الإدخال	$0.684 / 1M	$0.000 / 1M
سعر الإخراج	$3.420 / 1M	$0.000 / 1M
إجمالي رموز الإدخال	32,916	33,744
رموز الإخراج	16,410	2,596
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	13.27s	1.27s
زمن الاستجابة (الحد الأقصى)	238.89s	3.70s
زمن الاستجابة (الإجمالي)	278.57s	22.82s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	4.6	10.0	25.0%	0		1.39s	618	471	0
Elephant Alpha	6.6	10.0	50.0%	0		1.19s	726	815	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	5.5	9.8	33.3%	0		82.57s	5,986	14,754	0
Elephant Alpha	3.7	7.8	11.1%	1		1.30s	813	365	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	3.0	10.0	0.0%	0		3.38s	11,269	290	0
Elephant Alpha	3.0	10.0	0.0%	0		3.70s	14,046	562	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		1.32s	7,014	201	0
Elephant Alpha	6.5	10.0	50.0%	0		979ms	8,004	246	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	5.3	7.2	44.4%	1		1.48s	732	42	0
Elephant Alpha	3.0	10.0	0.0%	0		925ms	810	24	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	5.4	3.5	33.3%	1		1.55s	477	138	0
Elephant Alpha	4.3	10.0	0.0%	0		920ms	540	105	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	6.5	10.0	50.0%	0		1.64s	669	72	0
Elephant Alpha	9.8	10.0	100.0%	0		987ms	732	82	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	3.1	9.9	0.0%	0		1.40s	651	185	0
Elephant Alpha	5.3	10.0	33.3%	0		868ms	729	166	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	10.0	10.0	100.0%	0		4.46s	5,286	240	0
Elephant Alpha	3.0	10.0	0.0%	0		2.83s	7,344	231	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Kimi K2.6	3.0	10.0	0.0%	0		1.36s	214	17	0
Elephant Alpha	3.0	10.0	0.0%	0		0ms	0	0	0

مقارنة سريعة

تبديل زوج المقارنة

Kimi K2.5nonevsElephant Alphamedium Ling-2.6-flashnonevsElephant Alphamedium Elephant AlphamediumvsGLM 5 Turbonone DeepSeek V3.2nonevsElephant Alphamedium MiniMax M2.5mediumvsKimi K2.6noneمتاح مجانًا DeepSeek V4 FlashnonevsElephant Alphamedium CobuddymediumvsKimi K2.6noneمتاح مجانًا MiniMax M2.7mediumvsKimi K2.6noneمتاح مجانًا Elephant AlphamediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsKimi K2.6noneمتاح مجانًا Elephant AlphamediumvsQwen3 Coder Nextnone Nemotron 3 Supernoneمتاح مجانًاvsElephant Alphamedium