نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs StepFun: Step 3.7 Flash

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-29

میٹرک Qwen3.5-Flash Qwen3.5-Flash medium اجرا: 2026-02-24 Step 3.7 Flash Step 3.7 Flash high اجرا: 2026-05-29
اسکور 7.6 7.1
درجہ #51 #74
اعتماد پذیری 10.0 10.0
تسلسل 8.0 8.2
درست ٹیسٹس
فی کوشش کامیابی کی شرح 75.0% 65.8%
غیر مستحکم ٹیسٹ 5 4
کل رنز 60 60
فی نتیجہ لاگت 0.821 8.723
کل لاگت $0.099 $0.960
ان پٹ قیمت $0.065 / 1M $0.200 / 1M
آؤٹ پٹ قیمت $0.260 / 1M $1.150 / 1M
آؤٹ پٹ ٹوکنز 2,074 828,084
ریزننگ ٹوکنز 272,063 0
ردِعمل کا وقت (اوسط) 63.04s 49.43s
ردِعمل کا وقت (زیادہ سے زیادہ) 234.29s 192.75s
ردِعمل کا وقت (کل) 1197.71s 988.58s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
Step 3.7 Flash 10.0 10.0 100.0% 0 13.40s 42,656 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 4.1 5.8 33.3% 1 54.23s 288 67,546
Step 3.7 Flash 3.6 4.6 25.0% 1 126.82s 164,069 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
Step 3.7 Flash 10.0 10.0 100.0% 0 13.01s 8,802 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
Step 3.7 Flash 10.0 10.0 100.0% 0 14.72s 23,113 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
Step 3.7 Flash 4.1 4.4 44.5% 2 149.64s 410,502 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
Step 3.7 Flash 5.5 10.0 0.0% 0 4.17s 2,862 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
Step 3.7 Flash 9.8 10.0 100.0% 0 1.52s 2,010 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 89 12,457
Step 3.7 Flash 5.3 7.2 44.4% 1 10.22s 25,422 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
Step 3.7 Flash 10.0 10.0 100.0% 0 2.79s 1,172 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 32 37,037
Step 3.7 Flash 3.0 10.0 0.0% 0 149.34s 147,476 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں