نیویگیشن
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs Qwen3.8 27B (medium)

Qwen3.8 27B (medium) average score میں آگے ہے: 7.8 vs 7.7. مقامی ہارڈویئر کی لاگت نہیں ناپی گئی، اس لیے لاگت کا موازنہ دستیاب نہیں ہے۔ Qwen3.8 27B (medium) تیز ہے: 33.05s vs 92.50s، pass rates 63.6% vs 66.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#75
کل آؤٹ پٹ ٹوکنز
209,444
ردِعمل کا وقت (اوسط)
92.50s
کل لاگت
$0.555
درجہ
#68
کل آؤٹ پٹ ٹوکنز
136,162
ردِعمل کا وقت (اوسط)
33.05s
کل لاگت
دستیاب نہیں
تجویز کردہ ماڈل DeepSeek V4 Pro (high)

It has the best overall balance of score, reliability, cost, and response time in this comparison.

تفصیلی موازنہ

میٹرک DeepSeek V4 Pro DeepSeek V4 Pro high اجرا: 2026-04-24 Qwen3.8 27B Qwen3.8 27B medium اجرا: 2026-08-14
اسکور 7.7 7.8
درجہ #75 #68
اعتماد پذیری 10.0 9.6
تسلسل 7.7 9.7
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.6% 66.7%
غیر مستحکم ٹیسٹ 6 1
کل رنز 66 66
فی نتیجہ لاگت 2.251 دستیاب نہیں
کل لاگت $0.555 دستیاب نہیں
ان پٹ قیمت $1.169 / 1M دستیاب نہیں
آؤٹ پٹ قیمت $2.337 / 1M دستیاب نہیں
کل ان پٹ ٹوکنز 90,757 98,266
آؤٹ پٹ ٹوکنز 22,928 1,861
ریزننگ ٹوکنز 186,516 134,301
ردِعمل کا وقت (اوسط) 92.50s 33.05s
ردِعمل کا وقت (زیادہ سے زیادہ) 416.76s 214.63s
ردِعمل کا وقت (کل) 2035.01s 694.04s
پیرامیٹرز 1.6T کل (49B فعال) 27.3B
دستیابی کھلا ماخذ وزن دستیاب

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 DeepSeek V4 Pro

high
لاگت
$0.023
وقت
257.6s
ٹوکنز
14,870 tok

#68 Qwen3.8 27B

medium
لاگت
دستیاب نہیں
وقت
43.4s
ٹوکنز
2,956 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں