AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5 Nano

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-12

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GPT-5 Nano GPT-5 Nano medium الإصدار: 2025-08-07

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	GPT-5 Nano GPT-5 Nano medium الإصدار: 2025-08-07
الترتيب	#45	#38
متوسط الدرجة	4.9	5.5
الاتساق	7.4	7.0
التكلفة لكل نتيجة	0.214	0.856
إجمالي التكلفة	$0.015	$0.060
اختبارات صحيحة
معدل النجاح لكل محاولة	56.3%	60.4%
اختبارات غير مستقرة	5	6
إجمالي مرات التشغيل	48	48
رموز الإخراج	2,743	4,386
رموز الاستدلال	0	142,080
زمن الاستجابة (المتوسط)	2.49s	47.94s
زمن الاستجابة (الحد الأقصى)	6.70s	204.02s
زمن الاستجابة (الإجمالي)	39.91s	431.47s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

متوسط الدرجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	4.6	22.2%	2		2.93s	703	0
GPT-5 Nano	7.0	10.0	66.7%	0		37.73s	1,107	19,968

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	0.0%	0		6.59s	498	0
GPT-5 Nano	10.0	10.0	100.0%	0		65.96s	578	17,984

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	9.9	10.0	100.0%	0		1.82s	246	0
GPT-5 Nano	10.0	1.7	50.0%	2		21.42s	453	10,560

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	7.2	22.2%	1		1.33s	17	0
GPT-5 Nano	4.0	4.4	55.6%	2		204.02s	237	64,448

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
GPT-5 Nano	3.0	10.0	0.0%	0		17.51s	202	4,608

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
GPT-5 Nano	9.0	6.8	83.3%	1		11.90s	382	4,096

Puzzle Solving	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	4.0	4.4	55.6%	2		2.46s	620	0
GPT-5 Nano	4.0	7.2	44.4%	1		19.81s	869	13,440

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
GPT-5 Nano	10.0	10.0	100.0%	0		33.30s	558	6,976

مقارنة سريعة

تبديل زوج المقارنة

DeepSeek V3.2nonevsGPT-5 Nanomedium Seed-2.0-LitenonevsGrok 4.20 Multi-Agent Betamedium Seed-2.0-Litenonevsgpt-oss-120bmediumمتاح مجانًا Seed-2.0-LitenonevsMiniMax M2.5medium GPT-5 NanomediumvsQwen3.5-Flashnone Gemini 2.5 FlashnonevsGPT-5 Nanomedium Seed-2.0-LitenonevsMercury 2medium GPT-5 NanomediumvsGLM 5none GPT-5 NanomediumvsQwen3.5-122B-A10Bnone Seed-2.0-LitenonevsQwen3.5-35B-A3Bmedium GPT-5 NanomediumvsQwen3.5-27Bnone GPT-5 NanomediumvsQwen3.5 Plus 2026-02-15none