نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MoonshotAI: Kimi K2.7 Code vs OpenAI: GPT-5.6 Luna

average score تقریباً برابر ہے: 7.5 vs 7.6. GPT-5.6 Luna (medium) کی benchmark لاگت کم ہے: $0.352 vs $0.692. GPT-5.6 Luna (medium) تیز ہے: 7.28s vs 84.25s، pass rates 65.2% vs 65.2%.

تجویز کردہ ماڈلGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 2.0x less than Kimi K2.7 Code (medium).

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

موازنے کا خلاصہ

درجہ
#60
کل آؤٹ پٹ ٹوکنز
262,507
ردِعمل کا وقت (اوسط)
84.25s
کل لاگت
$0.692
درجہ
#57
کل آؤٹ پٹ ٹوکنز
43,679
ردِعمل کا وقت (اوسط)
7.28s
کل لاگت
$0.352

تفصیلی موازنہ

میٹرک Kimi K2.7 Code Kimi K2.7 Code medium اجرا: 2026-06-12 GPT-5.6 Luna GPT-5.6 Luna medium اجرا: 2026-07-09
اسکور 7.5 7.6
درجہ #60 #57
اعتماد پذیری 10.0 10.0
تسلسل 8.3 9.6
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 65.2%
غیر مستحکم ٹیسٹ 4 1
کل رنز 66 66
فی نتیجہ لاگت 6.457 2.513
کل لاگت $0.692 $0.352
ان پٹ قیمت $0.780 / 1M $1.000 / 1M
آؤٹ پٹ قیمت $3.500 / 1M $6.000 / 1M
کل ان پٹ ٹوکنز 72,073 89,676
آؤٹ پٹ ٹوکنز 83,714 5,699
ریزننگ ٹوکنز 178,793 37,980
ردِعمل کا وقت (اوسط) 84.25s 7.28s
ردِعمل کا وقت (زیادہ سے زیادہ) 365.80s 29.85s
ردِعمل کا وقت (کل) 1769.22s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
لاگت
$0.025
وقت
138.0s
ٹوکنز
6,093 tok

#57 GPT-5.6 Luna

medium
لاگت
$0.014
وقت
14.6s
ٹوکنز
2,362 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں