التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Google: Gemini 2.5 Flash

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-12

المقياس Seed-2.0-Lite Seed-2.0-Lite none الإصدار: 2026-02-14 Gemini 2.5 Flash Gemini 2.5 Flash none الإصدار: 2025-06-17
الترتيب #45 #42
متوسط الدرجة 4.9 5.2
الاتساق 7.4 9.1
التكلفة لكل نتيجة 0.214 0.191
إجمالي التكلفة $0.015 $0.012
اختبارات صحيحة
معدل النجاح لكل محاولة 56.3% 43.8%
اختبارات غير مستقرة 5 2
إجمالي مرات التشغيل 48 48
رموز الإخراج 2,743 1,270
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 2.49s 923ms
زمن الاستجابة (الحد الأقصى) 6.70s 4.39s
زمن الاستجابة (الإجمالي) 39.91s 14.78s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

متوسط الدرجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 4.6 22.2% 2 2.93s 703 0
Gemini 2.5 Flash 10.0 10.0 0.0% 0 668ms 99 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 0.0% 0 6.59s 498 0
Gemini 2.5 Flash 10.0 10.0 0.0% 0 4.39s 366 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 9.9 10.0 100.0% 0 1.82s 246 0
Gemini 2.5 Flash 9.9 10.0 100.0% 0 652ms 279 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 7.2 22.2% 1 1.33s 17 0
Gemini 2.5 Flash 4.0 7.2 55.6% 1 495ms 12 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
Gemini 2.5 Flash 5.0 10.0 0.0% 0 615ms 78 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
Gemini 2.5 Flash 9.0 6.8 66.7% 1 672ms 70 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 4.0 4.4 55.6% 2 2.46s 620 0
Gemini 2.5 Flash 4.7 10.0 33.3% 0 576ms 132 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
Gemini 2.5 Flash 10.0 10.0 100.0% 0 1.91s 234 0

مقارنة سريعة

تبديل زوج المقارنة