نیویگیشن
AI BENCHY
Advertise here

gpt-oss-120b (medium) vs Qwen3.5-35B-A3B (medium)

average score تقریباً برابر ہے: 6.1 vs 6.1. gpt-oss-120b (medium) کی benchmark لاگت کم ہے: $0.020 vs $1.140. gpt-oss-120b (medium) تیز ہے: 20.81s vs 110.84s، pass rates 50.0% vs 65.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-26

درجہ
#173
کل آؤٹ پٹ ٹوکنز
98,282
ردِعمل کا وقت (اوسط)
20.81s
کل لاگت
$0.020
درجہ
#172
کل آؤٹ پٹ ٹوکنز
893,463
ردِعمل کا وقت (اوسط)
110.84s
کل لاگت
$1.140
تجویز کردہ ماڈل gpt-oss-120b (medium)

It has the best score here (6.1), while costing about 59.9x less than Qwen3.5-35B-A3B (medium).

تفصیلی موازنہ

میٹرک gpt-oss-120b gpt-oss-120b medium اجرا: 2025-08-05 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium اجرا: 2026-02-24
اسکور 6.1 6.1
درجہ #173 #172
اعتماد پذیری 10.0 10.0
تسلسل 8.0 7.6
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 50.0% 65.2%
غیر مستحکم ٹیسٹ 5 6
کل رنز 66 66
فی نتیجہ لاگت 0.224 9.806
کل لاگت $0.020 $1.140
ان پٹ قیمت $0.037 / 1M $0.250 / 1M
آؤٹ پٹ قیمت $0.170 / 1M $1.250 / 1M
کل ان پٹ ٹوکنز 108,767 130,450
آؤٹ پٹ ٹوکنز 29,378 54,857
ریزننگ ٹوکنز 68,904 838,606
ردِعمل کا وقت (اوسط) 20.81s 110.84s
ردِعمل کا وقت (زیادہ سے زیادہ) 68.16s 950.25s
ردِعمل کا وقت (کل) 332.88s 2438.58s
پیرامیٹرز 117B کل (5.1B فعال) 35B کل (3B فعال)
دستیابی کھلا ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 gpt-oss-120b

medium
لاگت
$0.001
وقت
26.7s
ٹوکنز
555 tok

#172 Qwen3.5-35B-A3B

medium
لاگت
$0.009
وقت
71.4s
ٹوکنز
8,631 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
gpt-oss-120b 5.9 7.0 55.6% 1 38.37s 7,782 3,365 11,973
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں