نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.6 Luna vs xAI: Grok Build 0.1

average score تقریباً برابر ہے: 7.6 vs 7.6. GPT-5.6 Luna (medium) کی benchmark لاگت کم ہے: $0.352 vs $1.097. GPT-5.6 Luna (medium) تیز ہے: 7.28s vs 52.06s، pass rates 65.2% vs 63.6%.

تجویز کردہ ماڈلGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 3.1x less than Grok Build 0.1 (medium).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

موازنے کا خلاصہ

درجہ
#57
کل آؤٹ پٹ ٹوکنز
43,679
ردِعمل کا وقت (اوسط)
7.28s
کل لاگت
$0.352
درجہ
#55
کل آؤٹ پٹ ٹوکنز
494,663
ردِعمل کا وقت (اوسط)
52.06s
کل لاگت
$1.097

تفصیلی موازنہ

میٹرک GPT-5.6 Luna GPT-5.6 Luna medium اجرا: 2026-07-09 Grok Build 0.1 Grok Build 0.1 medium اجرا: 2026-05-21
اسکور 7.6 7.6
درجہ #57 #55
اعتماد پذیری 10.0 10.0
تسلسل 9.6 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 63.6%
غیر مستحکم ٹیسٹ 1 0
کل رنز 66 66
فی نتیجہ لاگت 2.513 7.830
کل لاگت $0.352 $1.097
ان پٹ قیمت $1.000 / 1M $1.000 / 1M
آؤٹ پٹ قیمت $6.000 / 1M $2.000 / 1M
کل ان پٹ ٹوکنز 89,676 106,751
آؤٹ پٹ ٹوکنز 5,699 7,993
ریزننگ ٹوکنز 37,980 486,670
ردِعمل کا وقت (اوسط) 7.28s 52.06s
ردِعمل کا وقت (زیادہ سے زیادہ) 29.85s 252.69s
ردِعمل کا وقت (کل) 160.27s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 GPT-5.6 Luna

medium
لاگت
$0.014
وقت
14.6s
ٹوکنز
2,362 tok

#55 xAI: Grok Build 0.1

medium
لاگت
$0.028
وقت
81.3s
ٹوکنز
14,009 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں