نیویگیشن
AI BENCHY
Advertise here

DeepSeek V4 Flash 0731 (high) vs GPT-5.2 Chat

average score تقریباً برابر ہے: 8.0 vs 8.0. DeepSeek V4 Flash 0731 (high) کی benchmark لاگت کم ہے: $0.123 vs $0.604. GPT-5.2 Chat تیز ہے: 7.65s vs 110.77s، pass rates 78.8% vs 74.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-01

درجہ
#40
کل آؤٹ پٹ ٹوکنز
544,164
ردِعمل کا وقت (اوسط)
110.77s
کل لاگت
$0.123
درجہ
#38
کل آؤٹ پٹ ٹوکنز
30,424
ردِعمل کا وقت (اوسط)
7.65s
کل لاگت
$0.604
تجویز کردہ ماڈل GPT-5.2 Chat

It has the best score here (8.0), while responding about 14.5x faster than DeepSeek V4 Flash 0731 (high).

تفصیلی موازنہ

میٹرک DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 high اجرا: 2026-08-01 GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11
اسکور 8.0 8.0
درجہ #40 #38
اعتماد پذیری 9.6 10.0
تسلسل 7.8 8.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 78.8% 74.2%
غیر مستحکم ٹیسٹ 6 4
کل رنز 66 66
فی نتیجہ لاگت 0.878 4.308
کل لاگت $0.123 $0.604
ان پٹ قیمت $0.140 / 1M $1.750 / 1M
آؤٹ پٹ قیمت $0.280 / 1M $14.000 / 1M
کل ان پٹ ٹوکنز 96,609 101,248
آؤٹ پٹ ٹوکنز 32,924 30,424
ریزننگ ٹوکنز 511,240 0
ردِعمل کا وقت (اوسط) 110.77s 7.65s
ردِعمل کا وقت (زیادہ سے زیادہ) 600.61s 38.52s
ردِعمل کا وقت (کل) 2437.00s 168.39s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 DeepSeek V4 Flash 0731

high
غلط SVG
لاگت
$0.000
وقت
187.3s
ٹوکنز
19,048 tok

#38 GPT-5.2 Chat

none
لاگت
$0.010
وقت
15.3s
ٹوکنز
797 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Flash 0731 6.3 4.2 77.8% 2 252.67s 7,044 2,160 191,210
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں