التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Nemotron 3 Super 120b A12b vs OpenAI: gpt-oss-120b

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-12

المقياس Nemotron 3 Super 120b A12b Nemotron 3 Super 120b A12b none الإصدار: 2026-03-11 متاح مجانًا gpt-oss-120b gpt-oss-120b medium الإصدار: 2025-08-05 متاح مجانًا
الترتيب #59 #43
متوسط الدرجة 3.4 5.1
الاتساق 8.6 7.4
التكلفة لكل نتيجة 0.000 0.135
إجمالي التكلفة $0.000 $0.010
اختبارات صحيحة
معدل النجاح لكل محاولة 31.3% 54.2%
اختبارات غير مستقرة 3 5
إجمالي مرات التشغيل 48 48
رموز الإخراج 4,222 13,210
رموز الاستدلال 0 34,230
زمن الاستجابة (المتوسط) 8.90s 16.65s
زمن الاستجابة (الحد الأقصى) 24.97s 50.92s
زمن الاستجابة (الإجمالي) 142.40s 149.88s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

متوسط الدرجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 10.0 0.0% 0 7.14s 2,171 0
gpt-oss-120b 7.0 9.8 66.7% 0 19.76s 3,463 2,077
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 10.0 0.0% 0 19.98s 124 0
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 694 5,072
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 9.9 10.0 100.0% 0 7.92s 249 0
gpt-oss-120b 5.5 5.9 66.7% 1 1.98s 241 1,114
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 7.2 22.2% 1 6.23s 26 0
gpt-oss-120b 10.0 4.4 22.2% 2 50.92s 6,784 20,606
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 3.0 9.9 0.0% 0 24.97s 170 0
gpt-oss-120b 3.0 10.0 0.0% 0 7.90s 107 387
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 4.5 6.9 33.3% 1 1.50s 66 0
gpt-oss-120b 9.5 10.0 100.0% 0 7.63s 126 1,799
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 4.7 10.0 33.3% 0 7.50s 1,135 0
gpt-oss-120b 1.7 4.7 22.2% 2 11.80s 1,508 2,092
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Nemotron 3 Super 120b A12b 10.0 1.6 66.7% 1 16.00s 281 0
gpt-oss-120b 9.0 10.0 100.0% 0 6.91s 287 1,083

مقارنة سريعة

تبديل زوج المقارنة