التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs OpenAI: GPT-5.4

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-04-11

المقياس DeepSeek V3.2 DeepSeek V3.2 medium الإصدار: 2025-12-01 GPT-5.4 GPT-5.4 medium الإصدار: 2026-03-05
النتيجة 8.0 8.2
الترتيب #25 #14
الاتساق 8.2 8.7
اختبارات صحيحة
معدل النجاح لكل محاولة 79.6% 79.6%
اختبارات غير مستقرة 4 3
إجمالي مرات التشغيل 54 54
التكلفة لكل نتيجة 0.240 6.399
إجمالي التكلفة $0.029 $0.832
??? ??????? $0.260 / 1M $2.500 / 1M
??? ??????? $0.380 / 1M $15.000 / 1M
رموز الإخراج 10,620 2,169
رموز الاستدلال 48,511 48,732
زمن الاستجابة (المتوسط) 46.41s 18.63s
زمن الاستجابة (الحد الأقصى) 180.92s 100.41s
زمن الاستجابة (الإجمالي) 835.33s 335.26s

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

حيل مضادة للذكاء الاصطناعي النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 8.4 9.9 75.0% 0 30.72s 3,773 7,523
GPT-5.4 8.3 10.0 75.0% 0 4.11s 240 1,511
البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
GPT-5.4 10.0 10.0 100.0% 0 13.03s 389 2,045
مجمّع النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
GPT-5.4 10.0 10.0 100.0% 0 20.57s 301 3,543
تحليل البيانات واستخراجها النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
GPT-5.4 10.0 10.0 100.0% 0 5.32s 234 804
خاص بالمجال النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 5.3 7.2 44.4% 1 39.32s 3,081 7,856
GPT-5.4 5.3 7.2 44.4% 1 74.27s 61 34,748
الذكاء العام النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
GPT-5.4 4.7 3.1 33.3% 1 4.92s 145 321
اتباع التعليمات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
GPT-5.4 10.0 10.0 100.0% 0 3.11s 93 897
حل الألغاز النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
GPT-5.4 8.2 7.2 88.9% 1 9.13s 442 3,832
استدعاء الأدوات النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإخراج رموز الاستدلال
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859
GPT-5.4 10.0 10.0 100.0% 0 13.28s 264 1,031

مقارنة سريعة

تبديل زوج المقارنة