نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs StepFun: Step 3.5 Flash

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-03

میٹرک GPT-5.2 Chat GPT-5.2 Chat none اجرا: 2025-12-11 Step 3.5 Flash Step 3.5 Flash medium اجرا: 2026-02-01
اسکور 7.9 7.4
درجہ #30 #55
اعتماد پذیری 10.0 10.0
تسلسل 8.9 9.4
درست ٹیسٹس
فی کوشش کامیابی کی شرح 73.3% 59.7%
غیر مستحکم ٹیسٹ 3 1
کل رنز 60 57
فی نتیجہ لاگت 2.703 0.133
کل لاگت $0.352 $0.062
ان پٹ قیمت $1.750 / 1M $0.090 / 1M
آؤٹ پٹ قیمت $14.000 / 1M $0.300 / 1M
کل ان پٹ ٹوکنز 31,593 33,555
آؤٹ پٹ ٹوکنز 21,144 90,478
ریزننگ ٹوکنز 0 173,544
ردِعمل کا وقت (اوسط) 6.82s 43.20s
ردِعمل کا وقت (زیادہ سے زیادہ) 38.52s 170.45s
ردِعمل کا وقت (کل) 136.34s 561.54s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 8.7 7.9 91.7% 1 3.40s 606 1,807 0
Step 3.5 Flash 10.0 10.0 100.0% 0 40.57s 694 20,391 24,176
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 8.2 6.7 83.3% 1 8.05s 4,686 4,131 0
Step 3.5 Flash 3.5 7.8 0.0% 0 62.83s 1,335 12,098 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 11,019 1,243 0
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 13,638 1,176 12,984
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 7,140 980 0
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 7,368 600 13,886
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 723 7,810 0
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 673 45,350 90,436
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 477 335 0
Step 3.5 Flash 5.5 10.0 0.0% 0 22.39s 509 240 3,506
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 9.8 10.0 100.0% 0 5.51s 660 1,441 0
Step 3.5 Flash 8.3 10.0 50.0% 0 4.78s 705 2,364 3,521
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.10s 642 1,603 0
Step 3.5 Flash 5.3 10.0 33.3% 0 7.22s 711 5,630 10,861
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 5,445 555 0
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 7,701 275 3,802
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.2 Chat 3.0 10.0 0.0% 0 6.89s 195 1,239 0
Step 3.5 Flash 3.0 10.0 0.0% 0 108.45s 221 2,354 10,372

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں