التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

IBM: Granite 4.1 8B vs Nemotron 3 Nano Omni 30b A3b Reasoning

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-05-01

المقياس Granite 4.1 8B Granite 4.1 8B none الإصدار: 2026-05-01 Nemotron 3 Nano Omni 30b A3b Reasoning Nemotron 3 Nano Omni 30b A3b Reasoning medium الإصدار: 2026-04-28 متاح مجانًا
النتيجة 4.3 5.2
الترتيب #135 #114
الموثوقية 10.0 10.0
الاتساق 10.0 5.9
اختبارات صحيحة
معدل النجاح لكل محاولة 11.1% 47.9%
اختبارات غير مستقرة 0 8
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.110 0.000
إجمالي التكلفة $0.003 $0.000
??? ??????? $0.050 / 1M $0.000 / 1M
??? ??????? $0.100 / 1M $0.000 / 1M
رموز الإخراج 2,712 50,628
رموز الاستدلال 0 184,655
زمن الاستجابة (المتوسط) 767ms 14.46s
زمن الاستجابة (الحد الأقصى) 2.17s 147.45s
زمن الاستجابة (الإجمالي) 13.81s 231.37s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 4.9 10.0 25.0% 0 844ms 903 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.0 5.9 75.0% 2 2.17s 2,490 3,481
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 6.9 10.0 0.0% 0 1.07s 339 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.3 1.7 33.3% 1 38.09s 6,097 30,508
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 1.88s 396 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 575ms 195 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.3 5.9 83.3% 1 2.72s 890 2,811
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.0 10.0 0.0% 0 357ms 24 0
Nemotron 3 Nano Omni 30b A3b Reasoning 2.9 7.2 11.1% 1 56.67s 40,404 142,623
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 4.0 10.0 0.0% 0 499ms 115 0
Nemotron 3 Nano Omni 30b A3b Reasoning 4.8 9.9 0.0% 0 1.43s 41 850
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.6 9.9 0.0% 0 344ms 66 0
Nemotron 3 Nano Omni 30b A3b Reasoning 7.1 6.6 66.7% 1 1.53s 192 1,728
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 3.7 10.0 0.0% 0 635ms 431 0
Nemotron 3 Nano Omni 30b A3b Reasoning 3.5 4.4 33.3% 2 1.56s 514 2,654
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Granite 4.1 8B 10.0 10.0 100.0% 0 2.17s 243 0
Nemotron 3 Nano Omni 30b A3b Reasoning 0.0 0.0 0.0% 0 0ms 0 0

مقارنة سريعة

تبديل زوج المقارنة