نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Qwen: Qwen3.5-9B

خلاصہ

GPT-5.4 vs Qwen3.5-9B benchmark موازنہ: GPT-5.4 average score میں آگے ہے: 5.8 vs 5.1. Qwen3.5-9B کی benchmark لاگت کم ہے: $0.006 vs $0.122. GPT-5.4 تیز ہے: 1.42s vs 1.89s، pass rates 36.5% vs 20.6%.

تجویز کردہ ماڈل: Qwen3.5-9B - Its score stays close to the best score here (5.1 vs 5.8), while costing about 22.6x less than GPT-5.4.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک GPT-5.4 GPT-5.4 none اجرا: 2026-03-05 Qwen3.5-9B Qwen3.5-9B none اجرا: 2026-03-02
اسکور 5.8 5.1
درجہ #112 #135
اعتماد پذیری 10.0 10.0
تسلسل 9.2 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 36.5% 20.6%
غیر مستحکم ٹیسٹ 2 1
کل رنز 63 63
فی نتیجہ لاگت 1.740 0.123
کل لاگت $0.122 $0.006
ان پٹ قیمت $2.500 / 1M $0.100 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $0.150 / 1M
کل ان پٹ ٹوکنز 34,212 48,041
آؤٹ پٹ ٹوکنز 2,417 3,952
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 1.42s 1.89s
ردِعمل کا وقت (زیادہ سے زیادہ) 2.95s 6.03s
ردِعمل کا وقت (کل) 29.87s 39.68s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#112 GPT-5.4

none
لاگت
$0.026
وقت
18.1s
ٹوکنز
1,792 tok

#135 Qwen3.5-9B

none
غلط SVG
لاگت
$0.000
وقت
300.0s
ٹوکنز
0 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
Qwen3.5-9B 3.1 9.9 0.0% 0 1.71s 696 582 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
Qwen3.5-9B 3.0 10.0 0.0% 0 5.91s 20,397 1,255 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
Qwen3.5-9B 10.0 10.0 100.0% 0 847ms 7,788 249 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Qwen3.5-9B 3.0 10.0 0.0% 0 464ms 789 24 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
Qwen3.5-9B 4.4 9.9 0.0% 0 552ms 522 99 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
Qwen3.5-9B 6.5 10.0 50.0% 0 514ms 711 75 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
Qwen3.5-9B 3.2 10.0 0.0% 0 621ms 714 347 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
Qwen3.5-9B 10.0 10.0 100.0% 0 1.27s 8,301 273 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0
Qwen3.5-9B 3.0 10.0 0.0% 0 2.32s 210 6 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں