نیویگیشن
AI BENCHY
Advertise here

GPT-5.5 vs Grok 4.20 (medium)

average score تقریباً برابر ہے: 7.0 vs 7.0. GPT-5.5 کی benchmark لاگت کم ہے: $0.544 vs $0.805. GPT-5.5 تیز ہے: 2.35s vs 32.56s، pass rates 59.1% vs 60.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#118
کل آؤٹ پٹ ٹوکنز
4,915
ردِعمل کا وقت (اوسط)
2.35s
کل لاگت
$0.544
درجہ
#120
کل آؤٹ پٹ ٹوکنز
270,259
ردِعمل کا وقت (اوسط)
32.56s
کل لاگت
$0.805
تجویز کردہ ماڈل GPT-5.5

It has the best score here (7.0), while responding about 13.8x faster than Grok 4.20 (medium).

تفصیلی موازنہ

میٹرک GPT-5.5 GPT-5.5 none اجرا: 2026-04-24 Grok 4.20 Grok 4.20 medium اجرا: 2026-03-31
اسکور 7.0 7.0
درجہ #118 #120
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.2
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 59.1% 60.6%
غیر مستحکم ٹیسٹ 2 5
کل رنز 66 66
فی نتیجہ لاگت 4.533 10.365
کل لاگت $0.544 $0.805
ان پٹ قیمت $5.000 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 79,294 102,986
آؤٹ پٹ ٹوکنز 4,915 5,860
ریزننگ ٹوکنز 0 264,399
ردِعمل کا وقت (اوسط) 2.35s 32.56s
ردِعمل کا وقت (زیادہ سے زیادہ) 12.24s 199.66s
ردِعمل کا وقت (کل) 51.78s 716.36s
پیرامیٹرز ~1.5T کل (~100B فعال) ~1T کل (~100B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
لاگت
$0.090
وقت
54.3s
ٹوکنز
3,063 tok

#120 SpaceXAI: Grok 4.20

medium
لاگت
$0.041
وقت
110.3s
ٹوکنز
16,336 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں