نیویگیشن
AI BENCHY
Advertise here

DeepSeek V4 Pro vs GLM 5.3 (low)

average score تقریباً برابر ہے: 6.8 vs 6.8. GLM 5.3 (low) کی benchmark لاگت کم ہے: $0.257 vs $0.351. DeepSeek V4 Pro تیز ہے: 11.71s vs 13.65s، pass rates 47.0% vs 65.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-20

درجہ
#133
کل آؤٹ پٹ ٹوکنز
35,547
ردِعمل کا وقت (اوسط)
11.71s
کل لاگت
$0.351
درجہ
#134
کل آؤٹ پٹ ٹوکنز
24,808
ردِعمل کا وقت (اوسط)
13.65s
کل لاگت
$0.257
تجویز کردہ ماڈل GLM 5.3 (low)

It has the strongest score in this comparison (6.8) and the best overall balance of cost and response time across all 2 models.

تفصیلی موازنہ

میٹرک DeepSeek V4 Pro DeepSeek V4 Pro none اجرا: 2026-04-24 GLM 5.3 GLM 5.3 low اجرا: 2026-08-20
اسکور 6.8 6.8
درجہ #133 #134
اعتماد پذیری 10.0 10.0
تسلسل 8.6 8.5
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 47.0% 65.2%
غیر مستحکم ٹیسٹ 4 4
کل رنز 66 66
فی نتیجہ لاگت 1.061 2.135
کل لاگت $0.351 $0.257
ان پٹ قیمت $1.600 / 1M $1.400 / 1M
آؤٹ پٹ قیمت $3.200 / 1M $4.400 / 1M
کل ان پٹ ٹوکنز 148,078 104,989
آؤٹ پٹ ٹوکنز 35,547 8,532
ریزننگ ٹوکنز 0 16,276
ردِعمل کا وقت (اوسط) 11.71s 13.65s
ردِعمل کا وقت (زیادہ سے زیادہ) 119.44s 83.60s
ردِعمل کا وقت (کل) 257.67s 300.22s
پیرامیٹرز 1.6T کل (49B فعال) 744B کل (40B فعال)
دستیابی کھلا ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 DeepSeek V4 Pro

none
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

#134 GLM 5.3

low
لاگت
$0.007
وقت
28.4s
ٹوکنز
1,599 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں