نیویگیشن
AI BENCHY
Advertise here

GPT-5.6 Sol vs Qwen3.5-122B-A10B (medium)

Qwen3.5-122B-A10B (medium) average score میں آگے ہے: 7.1 vs 7.0. GPT-5.6 Sol کی benchmark لاگت کم ہے: $0.262 vs $1.047. GPT-5.6 Sol تیز ہے: 2.17s vs 65.67s، pass rates 63.6% vs 71.2%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-20

درجہ
#116
کل آؤٹ پٹ ٹوکنز
4,357
ردِعمل کا وقت (اوسط)
2.17s
کل لاگت
$0.262
درجہ
#111
کل آؤٹ پٹ ٹوکنز
487,519
ردِعمل کا وقت (اوسط)
65.67s
کل لاگت
$1.047
تجویز کردہ ماڈل GPT-5.6 Sol

Its score stays close to the best score here (7.0 vs 7.1), while costing about 4.0x less than Qwen3.5-122B-A10B (medium).

تفصیلی موازنہ

میٹرک GPT-5.6 Sol GPT-5.6 Sol none اجرا: 2026-07-09 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium اجرا: 2026-02-24
اسکور 7.0 7.1
درجہ #116 #111
اعتماد پذیری 10.0 10.0
تسلسل 9.0 8.5
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.6% 71.2%
غیر مستحکم ٹیسٹ 3 4
کل رنز 66 66
فی نتیجہ لاگت 4.365 8.446
کل لاگت $0.262 $1.047
ان پٹ قیمت $2.500 / 1M $0.260 / 1M
آؤٹ پٹ قیمت $15.000 / 1M $2.080 / 1M
کل ان پٹ ٹوکنز 78,602 124,780
آؤٹ پٹ ٹوکنز 4,357 47,694
ریزننگ ٹوکنز 0 439,825
ردِعمل کا وقت (اوسط) 2.17s 65.67s
ردِعمل کا وقت (زیادہ سے زیادہ) 12.81s 519.30s
ردِعمل کا وقت (کل) 47.66s 1444.68s
پیرامیٹرز ~2T کل (~150B فعال) 122B کل (10B فعال)
دستیابی بند ماخذ کھلا ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#116 GPT-5.6 Sol

none
لاگت
$0.116
وقت
78.7s
ٹوکنز
3,944 tok

#111 Qwen3.5-122B-A10B

medium
لاگت
$0.019
وقت
48.7s
ٹوکنز
6,034 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں