التنقل
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Flash 0423 (high) vs GPT-5.2 Chat

يتقدم GPT-5.2 Chat في متوسط النتيجة بـ 7.9 مقابل 7.6. لدى DeepSeek V4 Flash 0423 (high) تكلفة benchmark أقل عند $0.031 مقابل $0.594. GPT-5.2 Chat أسرع عند 7.73s مقابل 51.81s، مع معدلات نجاح 69.7% مقابل 69.7%.

تم إنشاء نتائج المعايير من مجموعات اختبارات AI BENCHY في: 2026-08-15

الترتيب
#76
إجمالي رموز الإخراج
211,310
زمن الاستجابة (المتوسط)
51.81s
إجمالي التكلفة
$0.031
الترتيب
#59
إجمالي رموز الإخراج
29,742
زمن الاستجابة (المتوسط)
7.73s
إجمالي التكلفة
$0.594
النموذج الموصى به DeepSeek V4 Flash 0423 (high)

Its score stays close to the best score here (7.6 vs 7.9), while costing about 19.3x less than GPT-5.2 Chat.

مقارنة تفصيلية

المقياس DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high الإصدار: 2026-04-24 GPT-5.2 Chat GPT-5.2 Chat none الإصدار: 2025-12-11
النتيجة 7.6 7.9
الترتيب #76 #59
الموثوقية 10.0 10.0
الاتساق 8.5 8.6
محاولات 66/66 66/66
اختبارات صحيحة
معدل النجاح لكل محاولة 69.7% 69.7%
اختبارات غير مستقرة 4 4
إجمالي مرات التشغيل 66 66
التكلفة لكل نتيجة 0.446 4.564
إجمالي التكلفة $0.031 $0.594
سعر الإدخال $0.066 / 1M $1.750 / 1M
سعر الإخراج $0.132 / 1M $14.000 / 1M
إجمالي رموز الإدخال 108,480 101,104
رموز الإخراج 37,229 29,742
رموز الاستدلال 174,081 0
زمن الاستجابة (المتوسط) 51.81s 7.73s
زمن الاستجابة (الحد الأقصى) 218.13s 38.52s
زمن الاستجابة (الإجمالي) 1139.75s 162.40s
المعلمات 284B الإجمالي (13B النشطة) ~400B الإجمالي (~17B النشطة)
الإتاحة مفتوح المصدر مغلق المصدر

عرض إنشاء النماذج

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 DeepSeek V4 Flash 0423

high
التكلفة
$0.003
الوقت
93.1s
الرموز
7,926 tok

#59 GPT-5.2 Chat

none
التكلفة
$0.010
الوقت
15.3s
الرموز
797 tok

أفضل النماذج حسب الدرجة

الدرجة مقابل التكلفة الإجمالية

زمن الاستجابة (المتوسط)

النتيجة vs زمن الاستجابة (المتوسط)

إجمالي رموز الإخراج

النتيجة vs إجمالي رموز الإخراج

تفصيل الفئات

البرمجة النتيجة الاتساق معدل النجاح لكل محاولة اختبارات غير مستقرة اختبارات صحيحة زمن الاستجابة (المتوسط) رموز الإدخال رموز الإخراج رموز الاستدلال
DeepSeek V4 Flash 0423 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

مقارنة سريعة

تبديل زوج المقارنة