नेविगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Grok 4.6 (low)

Kimi K2.7 Code (medium) average score में आगे है: 7.4 vs 7.4. Grok 4.6 (low) की benchmark लागत कम है: $0.449 vs $0.709. Grok 4.6 (low) तेज है: 14.55s vs 80.09s, pass rates 63.6% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-14

रैंक
#89
कुल आउटपुट टोकन
239,546
प्रतिक्रिया समय (औसत)
80.09s
कुल लागत
$0.709
रैंक
#93
कुल आउटपुट टोकन
38,048
प्रतिक्रिया समय (औसत)
14.55s
कुल लागत
$0.449
अनुशंसित मॉडल Grok 4.6 (low)

Its score stays close to the best score here (7.4 vs 7.4), while costing about 1.6x less than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.4 7.4
रैंक #89 #93
विश्वसनीयता 10.0 10.0
संगति 8.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 69.7%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 7.096 2.989
कुल लागत $0.709 $0.449
इनपुट कीमत $0.710 / 1M $2.000 / 1M
आउटपुट कीमत $3.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 72,085 109,960
आउटपुट टोकन 57,453 5,124
रीजनिंग टोकन 182,093 32,924
प्रतिक्रिया समय (औसत) 80.09s 14.55s
प्रतिक्रिया समय (अधिकतम) 365.80s 26.46s
प्रतिक्रिया समय (कुल) 1681.85s 320.17s
पैरामीटर 1T कुल (32B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#89 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#93 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें