AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5.1

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-22

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GLM 5.1 GLM 5.1 none الإصدار: 2026-04-07

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GLM 5.1 GLM 5.1 none الإصدار: 2026-04-07
النتيجة	5.9	5.6
الترتيب	#99	#113
الموثوقية	10.0	10.0
الاتساق	7.9	8.1
اختبارات صحيحة
معدل النجاح لكل محاولة	50.0%	40.0%
اختبارات غير مستقرة	5	5
إجمالي مرات التشغيل	60	60
التكلفة لكل نتيجة	0.216	0.941
إجمالي التكلفة	$0.018	$0.057
??? ???????	$0.250 / 1M	$0.980 / 1M
??? ???????	$2.000 / 1M	$3.080 / 1M
رموز الإخراج	3,164	3,749
رموز الاستدلال	0	0
زمن الاستجابة (المتوسط)	2.44s	4.16s
زمن الاستجابة (الحد الأقصى)	6.70s	32.57s
زمن الاستجابة (الإجمالي)	48.71s	83.23s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
GLM 5.1	4.0	6.3	25.0%	2		2.11s	305	0

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	6.8	9.9	50.0%	0		2.95s	404	0
GLM 5.1	4.3	9.5	0.0%	0		6.33s	519	0

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
GLM 5.1	2.8	2.1	33.3%	1		32.57s	2,129	0

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
GLM 5.1	10.0	10.0	100.0%	0		1.08s	204	0

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
GLM 5.1	2.9	7.2	11.1%	1		1.99s	24	0

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
GLM 5.1	5.0	10.0	0.0%	0		790ms	39	0

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
GLM 5.1	9.8	10.0	100.0%	0		1.58s	66	0

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
GLM 5.1	6.1	7.8	44.4%	1		1.48s	152	0

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
GLM 5.1	10.0	10.0	100.0%	0		10.68s	300	0

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	11	0
GLM 5.1	3.0	10.0	0.0%	0		2.34s	11	0

مقارنة سريعة

تبديل زوج المقارنة

gpt-oss-120bmediumمتاح مجانًاvsGLM 5.1none Seed-2.0-LitenonevsOwl Alphamedium Seed-2.0-LitenonevsNemotron 3 Supermediumمتاح مجانًا Cobuddymediumمتاح مجانًاvsSeed-2.0-Litenone MiniMax M2.5mediumمتاح مجانًاvsGLM 5.1none Cobuddymediumمتاح مجانًاvsGLM 5.1none Mistral Small 4mediumvsGLM 5.1none Elephant AlphamediumvsGLM 5.1none Seed-2.0-LitenonevsGPT-5 Nanomedium Owl AlphamediumvsGLM 5.1none Seed-2.0-Litenonevsgpt-oss-120bmediumمتاح مجانًا Nemotron 3 Supermediumمتاح مجانًاvsGLM 5.1none