AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Inception: Mercury 2

الملخص

مقارنة benchmark بين Seed-2.0-Lite و Mercury 2: يتقدم Mercury 2 في متوسط النتيجة بـ 6.6 مقابل 5.8. لدى Seed-2.0-Lite تكلفة benchmark أقل عند $0.019 مقابل $0.058. Mercury 2 أسرع عند 2.24s مقابل 2.49s، مع معدلات نجاح 46.0% مقابل 54.0%.

النموذج الموصى به: Seed-2.0-Lite - It offers the best overall trade-off: a competitive score (5.8), lower cost than Mercury 2, and balanced response time.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-10

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	Mercury 2 Mercury 2 medium الإصدار: 2026-02-24

المقياس	Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14	Mercury 2 Mercury 2 medium الإصدار: 2026-02-24
النتيجة	5.8	6.6
الترتيب	#111	#82
الموثوقية	10.0	10.0
الاتساق	8.4	8.8
اختبارات صحيحة
معدل النجاح لكل محاولة	46.0%	54.0%
اختبارات غير مستقرة	4	3
إجمالي مرات التشغيل	63	63
التكلفة لكل نتيجة	0.228	0.578
إجمالي التكلفة	$0.019	$0.058
سعر الإدخال	$0.250 / 1M	$0.250 / 1M
سعر الإخراج	$2.000 / 1M	$0.750 / 1M
إجمالي رموز الإدخال	46,573	35,116
رموز الإخراج	3,259	4,048
رموز الاستدلال	0	61,219
زمن الاستجابة (المتوسط)	2.49s	2.24s
زمن الاستجابة (الحد الأقصى)	6.70s	14.63s
زمن الاستجابة (الإجمالي)	52.26s	44.72s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 Seed-2.0-Lite

none

Cost: $0.005
Time: 83.8s
Tokens: 2,311 tok

#82 Mercury 2

medium

Cost: $0.002
Time: 2.1s
Tokens: 1,702 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	894	709	0
Mercury 2	6.9	9.9	50.0%	0		1.12s	554	2,546	2,609

البرمجة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	5.6	10.0	33.3%	0		2.83s	8,215	410	0
Mercury 2	8.2	7.7	77.8%	1		2.04s	7,065	296	11,328

مجمّع	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	16,215	498	0
Mercury 2	10.0	10.0	100.0%	0		3.28s	12,909	268	4,887

تحليل البيانات واستخراجها	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	8,538	246	0
Mercury 2	7.3	5.9	83.3%	1		1.11s	6,234	183	1,656

خاص بالمجال	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	939	17	0
Mercury 2	2.9	7.2	11.1%	1		6.48s	695	41	30,754

الذكاء العام	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	570	294	0
Mercury 2	4.8	10.0	0.0%	0		821ms	456	137	542

اتباع التعليمات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	810	73	0
Mercury 2	10.0	10.0	100.0%	0		1.07s	340	14	958

حل الألغاز	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	5.3	7.2	44.4%	1		2.78s	858	709	0
Mercury 2	5.4	10.0	33.3%	0		949ms	601	361	2,781

استدعاء الأدوات	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	9,270	292	0
Mercury 2	10.0	10.0	100.0%	0		1.89s	6,080	180	1,956

معلومات عامة	النتيجة	الاتساق	معدل النجاح لكل محاولة	اختبارات غير مستقرة	اختبارات صحيحة	زمن الاستجابة (المتوسط)	رموز الإدخال	رموز الإخراج	رموز الاستدلال
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	264	11	0
Mercury 2	3.0	10.0	0.0%	0		2.58s	182	22	3,748

مقارنة سريعة

تبديل زوج المقارنة

Seed-2.0-LitenonevsNemotron 3 Supermediumمتاح مجانًا Gemma 4 31Bnoneمتاح مجانًاvsMercury 2medium CobuddymediumvsSeed-2.0-Litenone Claude Sonnet 4.6nonevsMercury 2medium Gemini 3.1 Flash LiteminimalvsMercury 2medium Mercury 2mediumvsQwen3.7 Plusnone Mercury 2mediumvsQwen3.6 Max Previewnone Gemini 3.1 Flash LitenonevsMercury 2medium Mercury 2mediumvsGPT-5.5none Seed-2.0-LitenonevsDeepSeek V4 Prohigh Seed-2.0-Litenonevsgpt-oss-120bmediumمتاح مجانًا Mercury 2mediumvsStep 3.7 Flashhigh