نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: gpt-oss-120b vs Z.ai: GLM 5.2

خلاصہ

gpt-oss-120b vs GLM 5.2 benchmark موازنہ: GLM 5.2 average score میں آگے ہے: 7.1 vs 6.7. gpt-oss-120b کی benchmark لاگت کم ہے: $0.013 vs $0.076. GLM 5.2 تیز ہے: 6.34s vs 22.28s، pass rates 52.4% vs 60.3%.

تجویز کردہ ماڈل: gpt-oss-120b - Its score stays close to the best score here (6.7 vs 7.1), while costing about 6.2x less than GLM 5.2.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-18

میٹرک gpt-oss-120b gpt-oss-120b medium اجرا: 2025-08-05 مفت دستیاب GLM 5.2 GLM 5.2 none اجرا: 2026-06-17
اسکور 6.7 7.1
درجہ #78 #61
اعتماد پذیری 10.0 9.9
تسلسل 8.0 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 52.4% 60.3%
غیر مستحکم ٹیسٹ 5 1
کل رنز 63 63
فی نتیجہ لاگت 0.141 0.628
کل لاگت $0.013 $0.076
ان پٹ قیمت $0.039 / 1M $1.400 / 1M
آؤٹ پٹ قیمت $0.180 / 1M $4.400 / 1M
کل ان پٹ ٹوکنز 39,084 38,671
آؤٹ پٹ ٹوکنز 20,013 4,817
ریزننگ ٹوکنز 50,233 0
ردِعمل کا وقت (اوسط) 22.28s 6.34s
ردِعمل کا وقت (زیادہ سے زیادہ) 68.16s 20.69s
ردِعمل کا وقت (کل) 311.96s 133.19s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 gpt-oss-120b

medium
لاگت
$0.001
وقت
26.7s
ٹوکنز
555 tok

#61 GLM 5.2

none
غلط SVG
لاگت
$0.033
وقت
87.7s
ٹوکنز
7,455 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں