التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Nemotron 3 Super 120b A12b vs xAI: Grok 4.1 Fast

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-12

المقياس Nemotron 3 Super 120b A12b Nemotron 3 Super 120b A12b medium الإصدار: 2026-03-11 متاح مجانًا Grok 4.1 Fast Grok 4.1 Fast medium الإصدار: 2025-11-19
الترتيب #36 #32
متوسط الدرجة 5.8 6.2
الاتساق 8.5 7.9
التكلفة لكل نتيجة 0.000 0.563
إجمالي التكلفة $0.000 $0.051
اختبارات صحيحة
معدل النجاح لكل محاولة 56.3% 66.7%
اختبارات غير مستقرة 3 4
إجمالي مرات التشغيل 48 48
رموز الإخراج 11,925 1,183
رموز الاستدلال 29,687 83,875
زمن الاستجابة (المتوسط) 20.24s 26.35s
زمن الاستجابة (الحد الأقصى) 87.80s 121.79s
زمن الاستجابة (الإجمالي) 303.60s 237.11s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

متوسط الدرجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 10.0 100.0% 0 12.96s 1,754 3,264
Grok 4.1 Fast 10.0 10.0 100.0% 0 5.65s 102 4,021
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 10.0 100.0% 0 87.80s 2,021 9,996
Grok 4.1 Fast 10.0 10.0 100.0% 0 37.64s 261 12,272
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 9.9 10.0 100.0% 0 18.16s 877 2,607
Grok 4.1 Fast 9.9 10.0 100.0% 0 6.63s 180 5,409
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 4.4 22.2% 2 16.19s 5,255 6,072
Grok 4.1 Fast 4.0 4.4 66.7% 2 121.79s 11 37,657
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 2.0 9.9 0.0% 0 27.86s 104 1,149
Grok 4.1 Fast 3.0 9.9 0.0% 0 16.25s 127 3,456
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 7.0 6.5 66.7% 1 7.72s 1,042 2,479
Grok 4.1 Fast 5.5 10.0 50.0% 0 5.30s 55 3,489
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 1.3 9.8 0.0% 0 8.39s 602 2,151
Grok 4.1 Fast 4.0 7.2 44.4% 1 8.08s 187 6,086
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 10.0 100.0% 0 39.75s 270 1,969
Grok 4.1 Fast 10.0 1.6 33.3% 1 27.71s 260 11,485

مقارنة سريعة

تبديل زوج المقارنة