نیویگیشن
Advertise here

GPT 5.3 Chat vs Qwen3.5-27B (medium)

average score تقریباً برابر ہے: 7.5 vs 7.5. GPT 5.3 Chat کی benchmark لاگت کم ہے: $0.533 vs $0.982. GPT 5.3 Chat تیز ہے: 6.56s vs 113.28s، pass rates 65.2% vs 75.8%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-28

موازنہ کیے گئے ماڈلز

درجہ
#122
کل آؤٹ پٹ ٹوکنز
28,179
ردِعمل کا وقت (اوسط)
6.56s
کل لاگت
$0.533
درجہ
#124
کل آؤٹ پٹ ٹوکنز
614,909
ردِعمل کا وقت (اوسط)
113.28s
کل لاگت
$0.982
تجویز کردہ ماڈل GPT 5.3 Chat

It has the best score here (7.5), while costing about 1.8x less than Qwen3.5-27B (medium).

تفصیلی موازنہ

میٹرک GPT 5.3 Chat GPT 5.3 Chat none اجرا: 2026-03-03 Qwen3.5-27B Qwen3.5-27B medium اجرا: 2026-02-24
اسکور 7.5 7.5
درجہ #122 #124
اعتماد پذیری 10.0 10.0
تسلسل 8.6 7.8
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 75.8%
غیر مستحکم ٹیسٹ 4 6
کل رنز 66 66
فی نتیجہ لاگت 4.097 8.217
کل لاگت $0.533 $0.982
ان پٹ قیمت $1.750 / 1M $0.195 / 1M
آؤٹ پٹ قیمت $14.000 / 1M $1.560 / 1M
کل ان پٹ ٹوکنز 78,846 111,644
آؤٹ پٹ ٹوکنز 28,179 16,113
ریزننگ ٹوکنز 0 598,796
ردِعمل کا وقت (اوسط) 6.56s 113.28s
ردِعمل کا وقت (زیادہ سے زیادہ) 18.33s 1026.43s
ردِعمل کا وقت (کل) 137.77s 2492.26s
پیرامیٹرز ~400B کل (~17B فعال) 27B
دستیابی بند ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT 5.3 Chat

none
لاگت
$0.008
وقت
8.1s
ٹوکنز
634 tok

#124 Qwen3.5-27B

medium
لاگت
$0.008
وقت
62.0s
ٹوکنز
3,099 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Qwen3.5-27B 6.2 7.1 55.6% 1 160.69s 7,895 6,381 89,388

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں