التنقل
AI BENCHY
Advertise here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs OpenAI: GPT-5.4

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-06-03

المقياس Seed-2.0-Lite Seed-2.0-Lite medium الإصدار: 2026-02-14 GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05
النتيجة 8.1 7.9
الترتيب #20 #27
الموثوقية 10.0 10.0
الاتساق 8.9 8.5
اختبارات صحيحة
معدل النجاح لكل محاولة 75.0% 75.0%
اختبارات غير مستقرة 3 4
إجمالي مرات التشغيل 60 60
التكلفة لكل نتيجة 1.166 8.765
إجمالي التكلفة $0.152 $1.140
سعر الإدخال $0.250 / 1M $2.500 / 1M
سعر الإخراج $2.000 / 1M $15.000 / 1M
إجمالي رموز الإدخال 43,785 31,489
رموز الإخراج 3,224 2,221
رموز الاستدلال 67,040 68,486
زمن الاستجابة (المتوسط) 36.67s 22.31s
زمن الاستجابة (الحد الأقصى) 168.71s 100.41s
زمن الاستجابة (الإجمالي) 733.46s 446.17s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 8.3 10.0 75.0% 0 17.99s 942 996 7,142
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 7.0 9.7 50.0% 0 107.65s 5,292 452 20,524
GPT-5.4 8.2 6.7 83.3% 1 54.98s 4,686 412 19,995
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 37.67s 16,254 506 4,299
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 9.07s 8,562 246 1,742
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 5.9 7.2 55.6% 1 88.74s 843 15 23,897
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 6.7 3.6 66.7% 1 18.25s 582 304 1,620
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 7.26s 834 71 1,480
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 9.0 7.9 88.9% 1 10.23s 894 403 3,285
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 12.38s 9,306 222 1,011
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.0 10.0 0.0% 0 48.32s 276 9 2,040
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

مقارنة سريعة

تبديل زوج المقارنة