نیویگیشن
AI BENCHY
موازنہ کریں چارٹس
❤️ Made by XCS
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.2 vs StepFun: Step 3.5 Flash

ماڈل کا نام:

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے : 2026-02-27 15:16

خلاصہ

میٹرک OpenAI: GPT-5.2 medium اجرا: ریلیز کی تاریخ نامعلوم StepFun: Step 3.5 Flash medium اجرا: ریلیز کی تاریخ نامعلوم مفت دستیاب
درجہ #12 #11
اسکور 6.93 7.00
تسلسل 8.22 8.32
فی نتیجہ لاگت 2.780 0.000
کل لاگت $0.251 $0.000
درست ٹیسٹس
غلط ٹیسٹس 5 5
فی کوشش کامیابی کی شرح 76.2% 73.8%
غیر مستحکم ٹیسٹ 3 3
آؤٹ پٹ ٹوکنز 1,869 60,502
ریزننگ ٹوکنز 14,190 117,044

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 7.00 7.28 77.8% 1 549 2,002
StepFun: Step 3.5 Flash 10.00 10.00 100.0% 0 13,924 17,208
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 10.00 10.00 100.0% 0 234 499
StepFun: Step 3.5 Flash 10.00 10.00 100.0% 0 535 11,548
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 4.00 7.21 55.6% 1 42 9,690
StepFun: Step 3.5 Flash 4.00 7.21 44.4% 1 40,942 74,237
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 9.50 10.00 100.0% 0 95 587
StepFun: Step 3.5 Flash 10.00 10.00 100.0% 0 2,121 3,274
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 8.00 10.00 66.7% 0 710 943
StepFun: Step 3.5 Flash 2.00 4.96 33.3% 2 2,705 6,975
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
OpenAI: GPT-5.2 1.00 1.62 66.7% 1 239 469
StepFun: Step 3.5 Flash 10.00 10.00 100.0% 0 275 3,802

موازنہ کی جوڑی تبدیل کریں