التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
Your ad here

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Mini vs Qwen: Qwen3.5-35B-A3B

اسم النموذج:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في : 2026-02-27 15:16

الملخص

المقياس ByteDance Seed: Seed-2.0-Mini medium الإصدار: 2026-02-26 Qwen: Qwen3.5-35B-A3B medium الإصدار: تاريخ الإصدار غير معروف
الترتيب #18 #22
النتيجة 6.13 5.93
الاتساق 8.91 6.62
التكلفة لكل نتيجة 0.177 5.169
إجمالي التكلفة $0.013 $0.362
اختبارات صحيحة
الاختبارات الخاطئة 7 7
معدل النجاح لكل محاولة 59.5% 73.8%
اختبارات غير مستقرة 2 6
رموز الإخراج 1,353 1,317
رموز الاستدلال 24,362 177,502

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 7.00 9.99 66.7% 0 354 9,352
Qwen: Qwen3.5-35B-A3B 10.00 10.00 100.0% 0 429 36,235
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 9.88 10.00 100.0% 0 246 2,743
Qwen: Qwen3.5-35B-A3B 5.50 5.87 83.3% 1 235 19,493
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 1.00 10.00 0.0% 0 0 0
Qwen: Qwen3.5-35B-A3B 1.00 4.41 44.5% 2 41 46,368
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 8.00 9.99 50.0% 0 69 2,050
Qwen: Qwen3.5-35B-A3B 8.00 6.80 66.7% 1 97 17,361
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 5.33 4.91 77.8% 2 462 4,982
Qwen: Qwen3.5-35B-A3B 4.33 4.70 66.7% 2 206 56,680
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
ByteDance Seed: Seed-2.0-Mini 10.00 10.00 100.0% 0 222 5,235
Qwen: Qwen3.5-35B-A3B 10.00 10.00 100.0% 0 309 1,365

تبديل زوج المقارنة