التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

IBM: Granite 4.1 8B vs Qwen: Qwen3 Coder Next

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-01

المقياس Granite 4.1 8B Granite 4.1 8B none الإصدار: 2026-05-01 Qwen3 Coder Next Qwen3 Coder Next medium الإصدار: 2026-02-03
النتيجة 4.3 4.9
الترتيب #135 #123
الموثوقية 10.0 غير متاح
الاتساق 10.0 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 11.1% 33.3%
اختبارات غير مستقرة 0 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.110 0.180
إجمالي التكلفة $0.003 $0.008
??? ??????? $0.050 / 1M $0.140 / 1M
??? ??????? $0.100 / 1M $0.800 / 1M
رموز الإخراج 2,712 3,241
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 767ms 10.75s
زمن الاستجابة (الحد الأقصى) 2.17s 81.80s
زمن الاستجابة (الإجمالي) 13.81s 129.01s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 903 0
Qwen3 Coder Next 3.5 8.1 16.7% 1 8.64s 1,252 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 6.9 10.0 0.0% 0 1.07s 339 0
Qwen3 Coder Next 4.7 1.6 66.7% 1 1.69s 300 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 396 0
Qwen3 Coder Next 3.0 10.0 0.0% 0 4.28s 317 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 195 0
Qwen3 Coder Next 6.5 10.0 50.0% 0 81.80s 246 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 24 0
Qwen3 Coder Next 5.3 10.0 33.3% 0 638ms 25 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 115 0
Qwen3 Coder Next 6.3 3.4 66.7% 1 1.39s 142 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 66 0
Qwen3 Coder Next 6.3 10.0 50.0% 0 7.34s 63 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.7 10.0 0.0% 0 635ms 431 0
Qwen3 Coder Next 3.1 10.0 0.0% 0 2.30s 641 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 243 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.64s 255 0

مقارنة سريعة

تبديل زوج المقارنة