AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5 Turbo

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-15

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GLM 5 Turbo GLM 5 Turbo medium الإصدار: 2026-03-15

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GLM 5 Turbo GLM 5 Turbo medium الإصدار: 2026-03-15
الترتيب	#43	#20
النتيجة	6.2	7.9
الاتساق	7.4	7.7
التكلفة لكل نتيجة	0.214	1.641
إجمالي التكلفة	$0.015	$0.165
اختبارات صحيحة
معدل النجاح لكل محاولة	56.3%	75.0%
اختبارات غير مستقرة	5	5
إجمالي مرات التشغيل	48	48
رموز الإخراج	2,743	11,853
رموز الاستدلال	0	35,095
زمن الاستجابة (المتوسط)	2.49s	18.84s
زمن الاستجابة (الحد الأقصى)	6.70s	194.23s
زمن الاستجابة (الإجمالي)	39.91s	301.50s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	4.6	22.2%	2		2.93s	703	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.01s	350	2,600

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
GLM 5 Turbo	10.0	10.0	100.0%	0		13.88s	390	2,037

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
GLM 5 Turbo	10.0	10.0	100.0%	0		6.19s	577	3,632

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
GLM 5 Turbo	2.9	4.4	22.2%	2		71.07s	9,665	19,279

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
GLM 5 Turbo	6.1	3.1	66.7%	1		10.05s	60	2,216

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.38s	255	2,183

Puzzle Solving	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
GLM 5 Turbo	7.3	5.8	55.6%	2		5.44s	315	2,702

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
GLM 5 Turbo	10.0	10.0	100.0%	0		9.84s	241	446

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-Litenonevsgpt-oss-120bmediumمتاح مجانًا Gemini 3 Flash PreviewnonevsGLM 5 Turbomedium Gemini 3.1 Flash Lite PreviewlowvsGLM 5 Turbomedium GPT-5.3 ChatnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsGLM 5 Turbomedium Seed-2.0-LitenonevsGrok 4.20 Multi-Agent Betamedium Seed-2.0-LitenonevsMiniMax M2.5mediumمتاح مجانًا Gemini 3.1 Flash Lite PreviewnonevsGLM 5 Turbomedium Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-LitenonevsMercury 2medium Claude Sonnet 4.6nonevsGLM 5 Turbomedium Seed-2.0-LitenonevsNemotron 3 Super 120b A12bmediumمتاح مجانًا