नेविगेशन
AI BENCHY
Advertise here

MoonshotAI: Kimi K2.7 Code vs OpenAI: GPT-5.6 Luna

average score लगभग बराबर है: 7.5 vs 7.6. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.352 vs $0.692. GPT-5.6 Luna (medium) तेज है: 7.28s vs 84.25s, pass rates 65.2% vs 65.2%.

अनुशंसित मॉडलGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 2.0x less than Kimi K2.7 Code (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

तुलना सारांश

रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
रैंक
#57
कुल आउटपुट टोकन
43,679
प्रतिक्रिया समय (औसत)
7.28s
कुल लागत
$0.352

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09
स्कोर 7.5 7.6
रैंक #60 #57
विश्वसनीयता 10.0 10.0
संगति 8.3 9.6
सही परीक्षण
प्रति प्रयास पास दर 65.2% 65.2%
अस्थिर टेस्ट 4 1
कुल रन 66 66
प्रति परिणाम लागत 6.457 2.513
कुल लागत $0.692 $0.352
इनपुट कीमत $0.780 / 1M $1.000 / 1M
आउटपुट कीमत $3.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 72,073 89,676
आउटपुट टोकन 83,714 5,699
रीजनिंग टोकन 178,793 37,980
प्रतिक्रिया समय (औसत) 84.25s 7.28s
प्रतिक्रिया समय (अधिकतम) 365.80s 29.85s
प्रतिक्रिया समय (कुल) 1769.22s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#57 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

त्वरित तुलना

तुलना जोड़ी बदलें