نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

OpenAI: gpt-oss-120b vs Qwen: Qwen3.7 Max

خلاصہ

gpt-oss-120b vs Qwen3.7 Max benchmark موازنہ: Qwen3.7 Max average score میں آگے ہے: 6.9 vs 6.7. gpt-oss-120b کی benchmark لاگت کم ہے: $0.013 vs $0.054. Qwen3.7 Max تیز ہے: 1.30s vs 22.28s، pass rates 52.4% vs 66.7%.

تجویز کردہ ماڈل: gpt-oss-120b - Its score stays close to the best score here (6.7 vs 6.9), while costing about 4.4x less than Qwen3.7 Max.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک gpt-oss-120b gpt-oss-120b medium اجرا: 2025-08-05 مفت دستیاب Qwen3.7 Max Qwen3.7 Max none اجرا: 2026-05-22
اسکور 6.7 6.9
درجہ #78 #69
اعتماد پذیری 10.0 10.0
تسلسل 8.0 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 52.4% 66.7%
غیر مستحکم ٹیسٹ 5 0
کل رنز 63 63
فی نتیجہ لاگت 0.141 0.744
کل لاگت $0.013 $0.054
ان پٹ قیمت $0.039 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $0.180 / 1M $3.750 / 1M
کل ان پٹ ٹوکنز 39,084 37,107
آؤٹ پٹ ٹوکنز 20,013 1,994
ریزننگ ٹوکنز 50,233 0
ردِعمل کا وقت (اوسط) 22.28s 1.30s
ردِعمل کا وقت (زیادہ سے زیادہ) 68.16s 3.92s
ردِعمل کا وقت (کل) 311.96s 27.21s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#78 gpt-oss-120b

medium
Cost
$0.001
Time
26.7s
Tokens
555 tok

#69 Qwen3.7 Max

none
Cost
$0.046
Time
195.0s
Tokens
12,171 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
Qwen3.7 Max 6.5 10.0 50.0% 0 1.08s 696 242 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
Qwen3.7 Max 3.0 10.0 0.0% 0 2.17s 9,549 171 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
Qwen3.7 Max 10.0 10.0 100.0% 0 1.35s 7,794 243 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Qwen3.7 Max 7.7 10.0 66.7% 0 975ms 789 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
Qwen3.7 Max 10.0 10.0 100.0% 0 1.04s 522 120 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
Qwen3.7 Max 10.0 10.0 100.0% 0 943ms 711 72 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
Qwen3.7 Max 10.0 10.0 100.0% 0 1.13s 714 314 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
Qwen3.7 Max 10.0 10.0 100.0% 0 3.92s 8,211 222 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758
Qwen3.7 Max 3.0 10.0 0.0% 0 856ms 210 13 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں