التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Laguna Xs.2

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-29

المقياس Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14 Laguna Xs.2 Laguna Xs.2 medium الإصدار: 2026-04-28 متاح مجانًا
النتيجة 6.2 6.2
الترتيب #79 #81
الموثوقية غير متاح 10.0
الاتساق 7.7 6.9
اختبارات صحيحة
معدل النجاح لكل محاولة 55.6% 57.4%
اختبارات غير مستقرة 5 7
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.200 0.000
إجمالي التكلفة $0.016 $0.000
??? ??????? $0.250 / 1M $0.000 / 1M
??? ??????? $2.000 / 1M $0.000 / 1M
رموز الإخراج 3,129 58,141
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 2.53s 6.03s
زمن الاستجابة (الحد الأقصى) 6.70s 29.11s
زمن الاستجابة (الإجمالي) 45.46s 108.59s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 709 0
Laguna Xs.2 7.4 5.9 83.3% 2 2.60s 5,283 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 4.61s 380 0
Laguna Xs.2 6.3 3.7 33.3% 1 14.36s 7,896 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 498 0
Laguna Xs.2 3.0 10.0 0.0% 0 15.92s 8,501 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 246 0
Laguna Xs.2 7.1 5.6 83.3% 1 9.34s 10,472 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 17 0
Laguna Xs.2 4.1 4.4 44.5% 2 11.12s 18,712 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
Laguna Xs.2 4.1 10.0 0.0% 0 2.76s 1,421 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
Laguna Xs.2 10.0 10.0 100.0% 0 1.68s 1,517 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 5.2 4.4 55.6% 2 2.46s 620 0
Laguna Xs.2 5.3 10.0 33.3% 0 2.12s 3,168 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
Laguna Xs.2 4.7 1.6 66.7% 1 3.39s 1,171 0

مقارنة سريعة

تبديل زوج المقارنة