التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Nemotron 3 Ultra 550b A55b vs xAI: Grok Build 0.1

الملخص

مقارنة benchmark بين Nemotron 3 Ultra 550b A55b و Grok Build 0.1: يتقدم Nemotron 3 Ultra 550b A55b في متوسط النتيجة بـ 8.1 مقابل 7.6. لدى Nemotron 3 Ultra 550b A55b تكلفة benchmark أقل عند $0.158 مقابل $0.927. Nemotron 3 Ultra 550b A55b أسرع عند 15.05s مقابل 49.90s، مع معدلات نجاح 69.8% مقابل 61.9%.

النموذج الموصى به: Nemotron 3 Ultra 550b A55b - It has the best score here (8.1), while costing about 5.9x less than Grok Build 0.1.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-07-02

المقياس Nemotron 3 Ultra 550b A55b Nemotron 3 Ultra 550b A55b medium الإصدار: 2026-06-04 متاح مجانًا Grok Build 0.1 Grok Build 0.1 medium الإصدار: 2026-05-21
النتيجة 8.1 7.6
الترتيب #26 #44
الموثوقية 9.7 10.0
الاتساق 8.8 9.9
اختبارات صحيحة
معدل النجاح لكل محاولة 69.8% 61.9%
اختبارات غير مستقرة 3 0
إجمالي مرات التشغيل 63 63
التكلفة لكل نتيجة 0.000 7.124
إجمالي التكلفة $0.158 $0.927
سعر الإدخال $0.500 / 1M $1.000 / 1M
سعر الإخراج $2.200 / 1M $2.000 / 1M
إجمالي رموز الإدخال 46,813 44,418
رموز الإخراج 18,002 2,782
رموز الاستدلال 53,091 438,018
زمن الاستجابة (المتوسط) 15.05s 49.90s
زمن الاستجابة (الحد الأقصى) 43.93s 252.69s
زمن الاستجابة (الإجمالي) 316.09s 1047.92s

عرض إنشاء

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Nemotron 3 Ultra 550b A55b

medium
SVG غير صالح
التكلفة
$0.000
الوقت
300.0s
الرموز
0 tok

#44 xAI: Grok Build 0.1

medium
التكلفة
$0.028
الوقت
81.3s
الرموز
14,009 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 8.62s 780 835 1,485
Grok Build 0.1 8.3 10.0 75.0% 0 7.43s 2,010 220 12,162
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 8.4 7.4 88.9% 1 26.53s 7,686 2,854 17,725
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 43.93s 17,574 1,040 3,590
Grok Build 0.1 10.0 10.0 100.0% 0 32.81s 12,909 231 16,917
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 5.68s 7,989 473 1,285
Grok Build 0.1 10.0 10.0 100.0% 0 10.72s 7,761 180 8,876
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 3.5 4.4 33.3% 2 24.90s 858 11,169 16,249
Grok Build 0.1 5.3 10.0 33.3% 0 158.00s 1,764 492 175,294
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 3.7 9.5 0.0% 0 2.52s 360 70 235
Grok Build 0.1 4.4 9.9 0.0% 0 18.41s 825 76 6,345
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 9.8 10.0 100.0% 0 6.35s 765 182 1,243
Grok Build 0.1 9.8 10.0 100.0% 0 12.36s 1,362 57 9,599
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 5.5 9.9 33.3% 0 3.54s 792 771 2,055
Grok Build 0.1 7.7 10.0 66.7% 0 18.26s 1,689 195 20,841
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 10.0 10.0 100.0% 0 7.72s 9,781 304 984
Grok Build 0.1 10.0 10.0 100.0% 0 13.12s 7,263 180 4,969
معلومات عامة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
Nemotron 3 Ultra 550b A55b 3.0 10.0 0.0% 0 38.47s 228 304 8,240
Grok Build 0.1 3.0 10.0 0.0% 0 53.51s 531 13 21,563

مقارنة سريعة

تبديل زوج المقارنة