नेविगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Grok Build 0.1 (medium)

Grok Build 0.1 (medium) average score में आगे है: 7.6 vs 7.5. Kimi K2.7 Code (medium) की benchmark लागत कम है: $0.692 vs $1.097. Grok Build 0.1 (medium) तेज है: 52.06s vs 84.25s, pass rates 65.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
रैंक
#55
कुल आउटपुट टोकन
494,663
प्रतिक्रिया समय (औसत)
52.06s
कुल लागत
$1.097
अनुशंसित मॉडल Kimi K2.7 Code (medium)

Its score stays close to the best score here (7.5 vs 7.6), while costing about 1.6x less than Grok Build 0.1 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 Grok Build 0.1 Grok Build 0.1 medium रिलीज़: 2026-05-21
स्कोर 7.5 7.6
रैंक #60 #55
विश्वसनीयता 10.0 10.0
संगति 8.3 10.0
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 4 0
कुल रन 66 66
प्रति परिणाम लागत 6.457 7.830
कुल लागत $0.692 $1.097
इनपुट कीमत $0.780 / 1M $1.000 / 1M
आउटपुट कीमत $3.500 / 1M $2.000 / 1M
कुल इनपुट टोकन 72,073 106,751
आउटपुट टोकन 83,714 7,993
रीजनिंग टोकन 178,793 486,670
प्रतिक्रिया समय (औसत) 84.25s 52.06s
प्रतिक्रिया समय (अधिकतम) 365.80s 252.69s
प्रतिक्रिया समय (कुल) 1769.22s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#55 xAI: Grok Build 0.1

medium
लागत
$0.028
समय
81.3s
टोकन
14,009 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

त्वरित तुलना

तुलना जोड़ी बदलें