التنقل
AI BENCHY
قارن الرسوم البيانية
❤️ Made by XCS
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Inception: Mercury 2

قارن:

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-03-05

المقياس DeepSeek: DeepSeek V3.2 none الإصدار: 2025-12-01 Inception: Mercury 2 medium الإصدار: 2026-02-24
الترتيب #38 #40
متوسط الدرجة 49 48
الاتساق 83 83
التكلفة لكل نتيجة 0.304 0.726
إجمالي التكلفة $0.016 $0.044
اختبارات صحيحة
معدل النجاح لكل محاولة 44.4% 51.1%
اختبارات غير مستقرة 3 3
رموز الإخراج 7,756 3,571
رموز الاستدلال 0 45,379

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 100 97 0.0% 0 1,411 0
Inception: Mercury 2 73 98 66.7% 0 2,531 2,410
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 80 100 0.0% 0 2,887 0
Inception: Mercury 2 100 100 100.0% 0 268 4,887
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 54 58 66.7% 1 1,710 0
Inception: Mercury 2 55 59 83.3% 1 183 1,656
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 100 72 22.2% 1 24 0
Inception: Mercury 2 100 72 11.1% 1 41 30,754
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 80 100 50.0% 0 66 0
Inception: Mercury 2 55 100 50.0% 0 14 958
Puzzle Solving النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 77 75 88.9% 1 1,136 0
Inception: Mercury 2 17 75 22.2% 1 354 2,758
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة رموز الإخراج رموز الاستدلال
DeepSeek: DeepSeek V3.2 100 100 100.0% 0 522 0
Inception: Mercury 2 100 100 100.0% 0 180 1,956

مقارنة سريعة

تبديل زوج المقارنة