نیویگیشن
Advertise here

Claude Opus 5.5 (high) vs GPT-6.1 Sol (medium)

GPT-6.1 Sol (medium) average score میں آگے ہے: 9.6 vs 9.3. GPT-6.1 Sol (medium) کی benchmark لاگت کم ہے: $0.326 vs $1.266. GPT-6.1 Sol (medium) تیز ہے: 6.99s vs 25.88s، pass rates 86.4% vs 93.9%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-29

موازنہ کیے گئے ماڈلز

درجہ
#26
کل آؤٹ پٹ ٹوکنز
36,457
ردِعمل کا وقت (اوسط)
25.88s
کل لاگت
$1.266
درجہ
#11
کل آؤٹ پٹ ٹوکنز
16,852
ردِعمل کا وقت (اوسط)
6.99s
کل لاگت
$0.326
تجویز کردہ ماڈل GPT-6.1 Sol (medium)

It has the best score here (9.6), while costing about 3.9x less than Claude Opus 5.5 (high).

تفصیلی موازنہ

میٹرک Claude Opus 5.5 Claude Opus 5.5 high اجرا: 2026-09-23 GPT-6.1 Sol GPT-6.1 Sol medium اجرا: 2026-09-29
اسکور 9.3 9.6
درجہ #26 #11
اعتماد پذیری 10.0 10.0
تسلسل 9.3 9.6
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 86.4% 93.9%
غیر مستحکم ٹیسٹ 2 1
کل رنز 66 66
فی نتیجہ لاگت 7.029 1.627
کل لاگت $1.266 $0.326
ان پٹ قیمت $4.000 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $20.000 / 1M $10.000 / 1M
کل ان پٹ ٹوکنز 134,020 78,368
آؤٹ پٹ ٹوکنز 7,237 4,354
ریزننگ ٹوکنز 29,220 12,498
ردِعمل کا وقت (اوسط) 25.88s 6.99s
ردِعمل کا وقت (زیادہ سے زیادہ) 95.95s 50.74s
ردِعمل کا وقت (کل) 569.33s 153.75s
پیرامیٹرز ~5T کل (~500B فعال) ~2T کل (~150B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Claude Opus 5.5

high
لاگت
$0.136
وقت
75.6s
ٹوکنز
6,934 tok

#11 GPT-6.1 Sol

medium
لاگت
$0.045
وقت
72.7s
ٹوکنز
4,581 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.74s 7,302 393 1,710

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں