نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs StepFun: Step 3.5 Flash

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-16

میٹرک GPT-5.3 Chat GPT-5.3 Chat none اجرا: 2026-03-03 Step 3.5 Flash Step 3.5 Flash medium اجرا: 2026-02-01
اسکور 7.7 7.9
درجہ #35 #30
تسلسل 8.6 9.1
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.5% 70.6%
غیر مستحکم ٹیسٹ 3 2
کل رنز 54 49
فی نتیجہ لاگت 3.082 0.000
کل لاگت $0.340 $0.000
?? ?? ???? $1.750 / 1M $0.100 / 1M
??? ?? ???? $14.000 / 1M $0.300 / 1M
آؤٹ پٹ ٹوکنز 20,784 71,904
ریزننگ ٹوکنز 0 155,607
ردِعمل کا وقت (اوسط) 5.88s 26.78s
ردِعمل کا وقت (زیادہ سے زیادہ) 18.33s 170.45s
ردِعمل کا وقت (کل) 105.90s 294.58s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Step 3.5 Flash 10.0 10.0 100.0% 0 13.56s 14,376 17,668
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 10.0 10.0 100.0% 0 9.32s 1,436 0
Step 3.5 Flash - - - - - - - -
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Step 3.5 Flash 5.5 10.0 0.0% 0 6.54s 2,214 2,584
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 8.3 10.0 50.0% 0 3.29s 1,455 0
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.93s 1,726 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں