التنقل
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Qwen: Qwen3 Coder Next

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-16

المقياس Mercury 2 Mercury 2 none الإصدار: 2026-02-24 Qwen3 Coder Next Qwen3 Coder Next medium الإصدار: 2026-02-03
النتيجة 4.8 4.7
الترتيب #89 #90
الاتساق 9.0 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 27.8% 27.8%
اختبارات غير مستقرة 2 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.165 0.240
إجمالي التكلفة $0.007 $0.008
??? ??????? $0.250 / 1M $0.150 / 1M
??? ??????? $0.750 / 1M $0.800 / 1M
رموز الإخراج 1,625 3,241
رموز الاستدلال 0 0
زمن الاستجابة (المتوسط) 613ms 10.75s
زمن الاستجابة (الحد الأقصى) 1.27s 81.80s
زمن الاستجابة (الإجمالي) 11.04s 129.01s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Qwen3 Coder Next 3.5 8.1 16.7% 1 8.64s 1,252 0
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Qwen3 Coder Next 4.7 1.6 66.7% 1 1.69s 300 0
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Qwen3 Coder Next 3.0 10.0 0.0% 0 4.28s 317 0
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Qwen3 Coder Next 6.5 10.0 50.0% 0 81.80s 246 0
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Qwen3 Coder Next 5.3 10.0 33.3% 0 638ms 25 0
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Qwen3 Coder Next 6.3 3.4 66.7% 1 1.39s 142 0
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Qwen3 Coder Next 4.8 10.0 0.0% 0 7.34s 63 0
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Qwen3 Coder Next 3.1 10.0 0.0% 0 2.30s 641 0
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Qwen3 Coder Next 10.0 10.0 100.0% 0 2.64s 255 0

مقارنة سريعة

تبديل زوج المقارنة