نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.5 vs Grok 4.3 (medium)

average score تقریباً برابر ہے: 7.0 vs 7.0. GPT-5.5 کی benchmark لاگت کم ہے: $0.544 vs $0.741. GPT-5.5 تیز ہے: 2.35s vs 44.21s، pass rates 59.1% vs 66.7%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#118
کل آؤٹ پٹ ٹوکنز
4,915
ردِعمل کا وقت (اوسط)
2.35s
کل لاگت
$0.544
درجہ
#114
کل آؤٹ پٹ ٹوکنز
225,904
ردِعمل کا وقت (اوسط)
44.21s
کل لاگت
$0.741
تجویز کردہ ماڈل GPT-5.5

It has the best score here (7.0), while responding about 18.8x faster than Grok 4.3 (medium).

تفصیلی موازنہ

میٹرک GPT-5.5 GPT-5.5 none اجرا: 2026-04-24 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 7.0 7.0
درجہ #118 #114
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.2
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 59.1% 66.7%
غیر مستحکم ٹیسٹ 2 5
کل رنز 66 66
فی نتیجہ لاگت 4.533 6.168
کل لاگت $0.544 $0.741
ان پٹ قیمت $5.000 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $30.000 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 79,294 140,244
آؤٹ پٹ ٹوکنز 4,915 13,739
ریزننگ ٹوکنز 0 212,165
ردِعمل کا وقت (اوسط) 2.35s 44.21s
ردِعمل کا وقت (زیادہ سے زیادہ) 12.24s 216.69s
ردِعمل کا وقت (کل) 51.78s 972.64s
پیرامیٹرز ~1.5T کل (~100B فعال) ~1.5T کل (~150B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
لاگت
$0.090
وقت
54.3s
ٹوکنز
3,063 tok

#114 SpaceXAI: Grok 4.3

medium
لاگت
$0.009
وقت
19.0s
ٹوکنز
3,661 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں