نیویگیشن
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.7 (low)

average score تقریباً برابر ہے: 7.4 vs 7.4. GPT-5.6 Luna (medium) کی benchmark لاگت کم ہے: $0.101 vs $2.263. GPT-5.6 Luna (medium) تیز ہے: 9.64s vs 63.19s، pass rates 62.3% vs 73.9%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-10-01

موازنہ کیے گئے ماڈلز

درجہ
#122
کل آؤٹ پٹ ٹوکنز
47,986
ردِعمل کا وقت (اوسط)
9.64s
کل لاگت
$0.101
درجہ
#127
کل آؤٹ پٹ ٹوکنز
255,329
ردِعمل کا وقت (اوسط)
63.19s
کل لاگت
$2.263
تجویز کردہ ماڈل GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 22.6x less than Grok 4.7 (low).

تفصیلی موازنہ

میٹرک GPT-5.6 Luna GPT-5.6 Luna medium اجرا: 2026-07-09 Grok 4.7 Grok 4.7 low اجرا: 2026-09-21
اسکور 7.4 7.4
درجہ #122 #127
اعتماد پذیری 10.0 10.0
تسلسل 9.0 8.3
کوششیں 69/69 69/69
درست ٹیسٹس
فی کوشش کامیابی کی شرح 62.3% 73.9%
غیر مستحکم ٹیسٹ 3 5
کل رنز 69 69
فی نتیجہ لاگت 2.822 13.804
کل لاگت $0.101 $2.263
ان پٹ قیمت $0.200 / 1M $2.000 / 1M
آؤٹ پٹ قیمت $1.200 / 1M $6.000 / 1M
کل ان پٹ ٹوکنز 212,780 365,119
آؤٹ پٹ ٹوکنز 6,849 8,118
ریزننگ ٹوکنز 41,137 247,211
ردِعمل کا وقت (اوسط) 9.64s 63.19s
ردِعمل کا وقت (زیادہ سے زیادہ) 58.09s 389.63s
ردِعمل کا وقت (کل) 221.62s 1453.28s
پیرامیٹرز ~400B کل (~17B فعال) ~1.7T کل (~170B فعال)
دستیابی بند ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
لاگت
$0.014
وقت
14.6s
ٹوکنز
2,362 tok

#127 SpaceXAI: Grok 4.7

low
لاگت
$0.007
وقت
15.2s
ٹوکنز
1,537 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں