نیویگیشن
Advertise here

GPT-5.4 Mini (medium) vs Qwen3.5-27B (medium)

average score تقریباً برابر ہے: 7.5 vs 7.5. GPT-5.4 Mini (medium) کی benchmark لاگت کم ہے: $0.786 vs $0.982. GPT-5.4 Mini (medium) تیز ہے: 26.72s vs 113.28s، pass rates 68.2% vs 75.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-10

موازنہ کیے گئے ماڈلز

درجہ
#109
کل آؤٹ پٹ ٹوکنز
158,344
ردِعمل کا وقت (اوسط)
26.72s
کل لاگت
$0.786
درجہ
#107
کل آؤٹ پٹ ٹوکنز
614,909
ردِعمل کا وقت (اوسط)
113.28s
کل لاگت
$0.982
تجویز کردہ ماڈل GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 4.2x faster than Qwen3.5-27B (medium).

تفصیلی موازنہ

میٹرک GPT-5.4 Mini GPT-5.4 Mini medium اجرا: 2026-03-17 Qwen3.5-27B Qwen3.5-27B medium اجرا: 2026-02-24
اسکور 7.5 7.5
درجہ #109 #107
اعتماد پذیری 10.0 10.0
تسلسل 8.1 7.8
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.2% 75.8%
غیر مستحکم ٹیسٹ 5 6
کل رنز 66 66
فی نتیجہ لاگت 6.546 8.217
کل لاگت $0.786 $0.982
ان پٹ قیمت $0.750 / 1M $0.195 / 1M
آؤٹ پٹ قیمت $4.500 / 1M $1.560 / 1M
کل ان پٹ ٹوکنز 97,164 111,644
آؤٹ پٹ ٹوکنز 6,211 16,113
ریزننگ ٹوکنز 152,133 598,796
ردِعمل کا وقت (اوسط) 26.72s 113.28s
ردِعمل کا وقت (زیادہ سے زیادہ) 138.75s 1026.43s
ردِعمل کا وقت (کل) 587.90s 2492.26s
پیرامیٹرز ~400B کل (~17B فعال) 27B
دستیابی بند ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#109 GPT-5.4 Mini

medium
لاگت
$0.056
وقت
95.5s
ٹوکنز
12,464 tok

#107 Qwen3.5-27B

medium
لاگت
$0.008
وقت
62.0s
ٹوکنز
3,099 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں