التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemma 4 26B A4B

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-26

المقياس Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14 Gemma 4 26B A4B Gemma 4 26B A4B none الإصدار: 2026-04-03 متاح مجانًا
النتيجة 6.2 6.2
الترتيب #72 #71
الموثوقية غير متاح غير متاح
الاتساق 7.7 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 55.6% 48.2%
اختبارات غير مستقرة 5 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.200 0.071
إجمالي التكلفة $0.016 $0.005
??? ??????? $0.250 / 1M $0.060 / 1M
??? ??????? $2.000 / 1M $0.330 / 1M
رموز الإخراج 3,129 1,783
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 2.53s 6.59s
زمن الاستجابة (الحد الأقصى) 6.70s 57.10s
زمن الاستجابة (الإجمالي) 45.46s 118.61s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 709 0
Gemma 4 26B A4B 8.3 10.0 75.0% 0 1.28s 230 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 4.61s 380 0
Gemma 4 26B A4B 4.7 1.6 66.7% 1 7.07s 448 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 498 0
Gemma 4 26B A4B 3.0 10.0 0.0% 0 30.53s 309 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 246 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 1.70s 285 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 17 0
Gemma 4 26B A4B 3.6 7.2 22.2% 1 2.49s 27 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
Gemma 4 26B A4B 4.0 10.0 0.0% 0 3.54s 85 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
Gemma 4 26B A4B 4.4 6.9 16.7% 1 1.08s 75 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 5.2 4.4 55.6% 2 2.46s 620 0
Gemma 4 26B A4B 5.7 10.0 33.3% 0 739ms 114 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
Gemma 4 26B A4B 10.0 10.0 100.0% 0 57.10s 210 0

مقارنة سريعة

تبديل زوج المقارنة