التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs xAI: Grok 4.1 Fast

اسم النموذج:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في : 2026-02-27 15:16

الملخص

المقياس ByteDance Seed: Seed-2.0-Mini medium الإصدار: 2026-02-26 xAI: Grok 4.1 Fast medium الإصدار: تاريخ الإصدار غير معروف
الترتيب #18 #16
النتيجة 6.13 6.29
الاتساق 8.91 8.20
التكلفة لكل نتيجة 0.177 0.532
إجمالي التكلفة $0.013 $0.043
اختبارات صحيحة
الاختبارات الخاطئة 7 6
معدل النجاح لكل محاولة 59.5% 66.7%
اختبارات غير مستقرة 2 3
رموز الإخراج 1,353 793
رموز الاستدلال 24,362 74,056

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 7.00 9.99 66.7% 0 354 9,352
xAI: Grok 4.1 Fast 10.00 10.00 100.0% 0 102 4,021
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 9.88 10.00 100.0% 0 246 2,743
xAI: Grok 4.1 Fast 10.00 10.00 100.0% 0 180 5,472
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 1.00 10.00 0.0% 0 0 0
xAI: Grok 4.1 Fast 4.00 7.21 55.6% 1 12 40,547
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 8.00 9.99 50.0% 0 69 2,050
xAI: Grok 4.1 Fast 5.50 10.00 50.0% 0 48 3,151
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 5.33 4.91 77.8% 2 462 4,982
xAI: Grok 4.1 Fast 4.67 7.20 44.4% 1 191 9,380
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 10.00 10.00 100.0% 0 222 5,235
xAI: Grok 4.1 Fast 1.00 1.62 33.3% 1 260 11,485

تبديل زوج المقارنة