نیویگیشن
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Grok Build 0.1 (medium)

Grok Build 0.1 (medium) average score میں آگے ہے: 7.6 vs 7.5. Kimi K2.7 Code (medium) کی benchmark لاگت کم ہے: $0.692 vs $1.097. Grok Build 0.1 (medium) تیز ہے: 52.06s vs 84.25s، pass rates 65.2% vs 63.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-25

درجہ
#60
کل آؤٹ پٹ ٹوکنز
262,507
ردِعمل کا وقت (اوسط)
84.25s
کل لاگت
$0.692
درجہ
#55
کل آؤٹ پٹ ٹوکنز
494,663
ردِعمل کا وقت (اوسط)
52.06s
کل لاگت
$1.097
تجویز کردہ ماڈل Kimi K2.7 Code (medium)

Its score stays close to the best score here (7.5 vs 7.6), while costing about 1.6x less than Grok Build 0.1 (medium).

تفصیلی موازنہ

میٹرک Kimi K2.7 Code Kimi K2.7 Code medium اجرا: 2026-06-12 Grok Build 0.1 Grok Build 0.1 medium اجرا: 2026-05-21
اسکور 7.5 7.6
درجہ #60 #55
اعتماد پذیری 10.0 10.0
تسلسل 8.3 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 63.6%
غیر مستحکم ٹیسٹ 4 0
کل رنز 66 66
فی نتیجہ لاگت 6.457 7.830
کل لاگت $0.692 $1.097
ان پٹ قیمت $0.780 / 1M $1.000 / 1M
آؤٹ پٹ قیمت $3.500 / 1M $2.000 / 1M
کل ان پٹ ٹوکنز 72,073 106,751
آؤٹ پٹ ٹوکنز 83,714 7,993
ریزننگ ٹوکنز 178,793 486,670
ردِعمل کا وقت (اوسط) 84.25s 52.06s
ردِعمل کا وقت (زیادہ سے زیادہ) 365.80s 252.69s
ردِعمل کا وقت (کل) 1769.22s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
لاگت
$0.025
وقت
138.0s
ٹوکنز
6,093 tok

#55 xAI: Grok Build 0.1

medium
لاگت
$0.028
وقت
81.3s
ٹوکنز
14,009 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں