نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

StepFun: Step 3.5 Flash vs Z.ai: GLM 5.1

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-04-29

میٹرک Step 3.5 Flash Step 3.5 Flash medium اجرا: 2026-02-01 GLM 5.1 GLM 5.1 medium اجرا: 2026-04-07
اسکور 7.9 7.8
درجہ #40 #44
اعتماد پذیری دستیاب نہیں دستیاب نہیں
تسلسل 9.1 8.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 70.6% 75.9%
غیر مستحکم ٹیسٹ 2 3
کل رنز 49 54
فی نتیجہ لاگت 0.000 1.674
کل لاگت $0.000 $0.201
?? ?? ???? $0.100 / 1M $1.050 / 1M
??? ?? ???? $0.300 / 1M $3.500 / 1M
آؤٹ پٹ ٹوکنز 71,904 8,005
ریزننگ ٹوکنز 155,607 49,090
ردِعمل کا وقت (اوسط) 26.78s 24.13s
ردِعمل کا وقت (زیادہ سے زیادہ) 170.45s 118.52s
ردِعمل کا وقت (کل) 294.58s 410.25s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 10.0 10.0 100.0% 0 13.56s 14,376 17,668
GLM 5.1 10.0 10.0 100.0% 0 8.31s 401 5,122
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
GLM 5.1 9.5 10.0 100.0% 0 43.11s 327 4,206
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
GLM 5.1 10.0 10.0 100.0% 0 9.33s 991 4,552
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
GLM 5.1 5.3 10.0 33.3% 0 29.77s 969 11,314
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 5.5 10.0 0.0% 0 6.54s 2,214 2,584
GLM 5.1 10.0 10.0 100.0% 0 20.95s 2,875 2,875
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
GLM 5.1 6.4 5.8 66.7% 1 7.47s 204 1,617
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
GLM 5.1 8.2 7.2 88.9% 1 23.85s 899 5,627
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802
GLM 5.1 3.0 10.0 0.0% 0 0ms 0 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Step 3.5 Flash - - - - - - - -
GLM 5.1 4.7 1.6 66.7% 1 118.52s 1,339 13,777

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں