نیویگیشن
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

GPT-5.4 (medium) average score میں آگے ہے: 8.8 vs 8.7. Qwen3.8 27B (high) کی benchmark لاگت کم ہے: ~$0.298 vs $2.006. GPT-5.4 (medium) تیز ہے: 24.81s vs 166.34s، pass rates 78.3% vs 78.3%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#50
کل آؤٹ پٹ ٹوکنز
96,502
ردِعمل کا وقت (اوسط)
24.81s
کل لاگت
$2.006
درجہ
#55
کل آؤٹ پٹ ٹوکنز
677,080
ردِعمل کا وقت (اوسط)
166.34s
کل لاگت
~$0.298
تجویز کردہ ماڈل Qwen3.8 27B (high)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 6.7x less than GPT-5.4 (medium).

تفصیلی موازنہ

میٹرک GPT-5.4 GPT-5.4 medium اجرا: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high اجرا: 2026-08-14 مفت دستیاب
اسکور 8.8 8.7
درجہ #50 #55
اعتماد پذیری 10.0 9.7
تسلسل 8.7 9.2
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 78.3% 78.3%
غیر مستحکم ٹیسٹ 4 2
کل رنز 69 69
فی نتیجہ لاگت 12.535 ~1.751
کل لاگت $2.006 ~$0.298
ان پٹ قیمت $2.500 / 1M دستیاب نہیں
آؤٹ پٹ قیمت $15.000 / 1M دستیاب نہیں
کل ان پٹ ٹوکنز 223,210 348,967
آؤٹ پٹ ٹوکنز 7,312 1,005
ریزننگ ٹوکنز 89,190 676,075
ردِعمل کا وقت (اوسط) 24.81s 166.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 100.41s 640.85s
ردِعمل کا وقت (کل) 570.60s 3825.81s
پیرامیٹرز ~1.5T کل (~100B فعال) 27.3B
دستیابی بند ماخذ وزن دستیاب

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
لاگت
$0.214
وقت
199.6s
ٹوکنز
14,349 tok

#55 Qwen3.8 27B

high
لاگت
~$0.008
وقت
270.1s
ٹوکنز
18,963 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں

GPT-5.2mediumvsQwen3.8 27Bhighمفت دستیابQwen3.8 27Bhighمفت دستیابvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27Bhighمفت دستیابGPT-6 SollowvsQwen3.8 27Bhighمفت دستیابGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhighمفت دستیابMuse Spark 1.2lowvsQwen3.8 27Bhighمفت دستیابMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27Bhighمفت دستیابMuse Spark 1.1lowvsQwen3.8 27Bhighمفت دستیابClaude Sonnet 5.5xhighvsQwen3.8 27Bhighمفت دستیاب