نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.4 vs Qwen: Qwen3.5-Flash

خلاصہ

GPT-5.4 vs Qwen3.5-Flash benchmark موازنہ: Qwen3.5-Flash average score میں آگے ہے: 6.1 vs 5.8. Qwen3.5-Flash کی benchmark لاگت کم ہے: $0.005 vs $0.122. GPT-5.4 تیز ہے: 1.42s vs 3.58s، pass rates 36.5% vs 39.7%.

تجویز کردہ ماڈل: Qwen3.5-Flash - It has the best score here (6.1), while costing about 29.5x less than GPT-5.4.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک GPT-5.4 GPT-5.4 none اجرا: 2026-03-05 Qwen3.5-Flash Qwen3.5-Flash none اجرا: 2026-02-24
اسکور 5.8 6.1
درجہ #112 #97
اعتماد پذیری 10.0 10.0
تسلسل 9.2 9.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 36.5% 39.7%
غیر مستحکم ٹیسٹ 2 1
کل رنز 63 63
فی نتیجہ لاگت 1.740 0.075
کل لاگت $0.122 $0.005
ان پٹ قیمت $2.500 / 1M $0.065 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $0.260 / 1M
کل ان پٹ ٹوکنز 34,212 46,439
آؤٹ پٹ ٹوکنز 2,417 4,276
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 1.42s 3.58s
ردِعمل کا وقت (زیادہ سے زیادہ) 2.95s 27.18s
ردِعمل کا وقت (کل) 29.87s 75.28s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#112 GPT-5.4

none
لاگت
$0.026
وقت
18.1s
ٹوکنز
1,792 tok

#97 Qwen3.5-Flash

none
لاگت
$0.003
وقت
47.4s
ٹوکنز
7,799 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
Qwen3.5-Flash 3.5 8.3 8.3% 1 1.32s 696 690 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.5 10.0 33.3% 0 1.62s 7,305 516 0
Qwen3.5-Flash 5.5 10.0 33.3% 0 850ms 7,913 519 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
Qwen3.5-Flash 3.0 10.0 0.0% 0 6.22s 18,879 1,794 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 1.57s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Qwen3.5-Flash 7.7 10.0 66.7% 0 905ms 789 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 803ms 522 100 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
Qwen3.5-Flash 6.3 10.0 50.0% 0 8.81s 711 63 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
Qwen3.5-Flash 3.1 10.0 0.0% 0 10.89s 714 579 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
Qwen3.5-Flash 10.0 10.0 100.0% 0 3.67s 8,211 264 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0
Qwen3.5-Flash 3.0 10.0 0.0% 0 588ms 210 9 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں