التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Nemotron 3 Super 120b A12b

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-12

المقياس Mercury 2 Mercury 2 medium الإصدار: 2026-02-24 Nemotron 3 Super 120b A12b Nemotron 3 Super 120b A12b none الإصدار: 2026-03-11 متاح مجانًا
الترتيب #40 #59
متوسط الدرجة 5.3 3.4
الاتساق 8.4 8.6
التكلفة لكل نتيجة 0.631 0.000
إجمالي التكلفة $0.045 $0.000
اختبارات صحيحة
معدل النجاح لكل محاولة 54.2% 31.3%
اختبارات غير مستقرة 3 3
إجمالي مرات التشغيل 48 48
رموز الإخراج 3,708 4,222
رموز الاستدلال 45,921 0
زمن الاستجابة (المتوسط) 2.36s 8.90s
زمن الاستجابة (الحد الأقصى) 14.63s 24.97s
زمن الاستجابة (الإجمالي) 35.39s 142.40s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

متوسط الدرجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

متوسط الدرجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 7.3 9.8 66.7% 0 1.30s 2,531 2,410
Nemotron 3 Super 120b A12b 10.0 10.0 0.0% 0 7.14s 2,171 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Nemotron 3 Super 120b A12b 10.0 10.0 0.0% 0 19.98s 124 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 5.5 5.9 83.3% 1 1.11s 183 1,656
Nemotron 3 Super 120b A12b 9.9 10.0 100.0% 0 7.92s 249 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 10.0 7.2 11.1% 1 6.48s 41 30,754
Nemotron 3 Super 120b A12b 10.0 7.2 22.2% 1 6.23s 26 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 4.0 10.0 0.0% 0 821ms 137 542
Nemotron 3 Super 120b A12b 3.0 9.9 0.0% 0 24.97s 170 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Nemotron 3 Super 120b A12b 4.5 6.9 33.3% 1 1.50s 66 0
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 1.7 7.5 22.2% 1 934ms 354 2,758
Nemotron 3 Super 120b A12b 4.7 10.0 33.3% 0 7.50s 1,135 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Nemotron 3 Super 120b A12b 10.0 1.6 66.7% 1 16.00s 281 0

مقارنة سريعة

تبديل زوج المقارنة