التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Inception: Mercury 2

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-16

المقياس DeepSeek V3.2 DeepSeek V3.2 none الإصدار: 2025-12-01 Mercury 2 Mercury 2 medium الإصدار: 2026-02-24
النتيجة 6.1 6.5
الترتيب #63 #53
الاتساق 8.1 8.6
اختبارات صحيحة
معدل النجاح لكل محاولة 50.0% 53.7%
اختبارات غير مستقرة 4 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.226 0.580
إجمالي التكلفة $0.016 $0.047
??? ??????? $0.260 / 1M $0.250 / 1M
??? ??????? $0.380 / 1M $0.750 / 1M
رموز الإخراج 8,384 3,972
رموز الاستدلال 0 48,333
زمن الاستجابة (المتوسط) 12.09s 2.21s
زمن الاستجابة (الحد الأقصى) 115.89s 14.63s
زمن الاستجابة (الإجمالي) 217.56s 37.51s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 3.2 9.8 0.0% 0 7.63s 1,419 0
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 2.4 1.3 33.3% 1 7.63s 553 0
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 6.5 10.0 0.0% 0 115.89s 2,887 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 6.3 5.8 66.7% 1 9.42s 1,710 0
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 3.6 7.2 22.2% 1 1.61s 24 0
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 2.86s 67 0
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 1.52s 66 0
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 8.5 7.5 88.9% 1 7.37s 1,136 0
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 11.85s 522 0
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956

مقارنة سريعة

تبديل زوج المقارنة