نیویگیشن
Advertise here

Claude Opus 5.5 (high) vs GPT-5.5 (low)

GPT-5.5 (low) average score میں آگے ہے: 9.3 vs 9.3. GPT-5.5 (low) کی benchmark لاگت کم ہے: $1.257 vs $1.266. GPT-5.5 (low) تیز ہے: 10.15s vs 25.88s، pass rates 86.4% vs 86.4%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-09-23

موازنہ کیے گئے ماڈلز

درجہ
#21
کل آؤٹ پٹ ٹوکنز
36,457
ردِعمل کا وقت (اوسط)
25.88s
کل لاگت
$1.266
درجہ
#18
کل آؤٹ پٹ ٹوکنز
28,540
ردِعمل کا وقت (اوسط)
10.15s
کل لاگت
$1.257
تجویز کردہ ماڈل GPT-5.5 (low)

It has the best score here (9.3), while responding about 2.6x faster than Claude Opus 5.5 (high).

تفصیلی موازنہ

میٹرک Claude Opus 5.5 Claude Opus 5.5 high اجرا: 2026-09-23 GPT-5.5 GPT-5.5 low اجرا: 2026-04-24
اسکور 9.3 9.3
درجہ #21 #18
اعتماد پذیری 10.0 10.0
تسلسل 9.3 10.0
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 86.4% 86.4%
غیر مستحکم ٹیسٹ 2 0
کل رنز 66 66
فی نتیجہ لاگت 7.029 6.614
کل لاگت $1.266 $1.257
ان پٹ قیمت $4.000 / 1M $5.000 / 1M
آؤٹ پٹ قیمت $20.000 / 1M $30.000 / 1M
کل ان پٹ ٹوکنز 134,020 80,067
آؤٹ پٹ ٹوکنز 7,237 5,378
ریزننگ ٹوکنز 29,220 23,162
ردِعمل کا وقت (اوسط) 25.88s 10.15s
ردِعمل کا وقت (زیادہ سے زیادہ) 95.95s 56.19s
ردِعمل کا وقت (کل) 569.33s 223.24s
پیرامیٹرز ~5T کل (~500B فعال) ~1.5T کل (~100B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 Claude Opus 5.5

high
لاگت
$0.136
وقت
75.6s
ٹوکنز
6,934 tok

#18 GPT-5.5

low
لاگت
$0.068
وقت
37.0s
ٹوکنز
2,339 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں