नेविगेशन
Advertise here

Kimi K2.7 Code (medium) vs GPT-5.4 Mini (medium)

average score लगभग बराबर है: 7.4 vs 7.5. Kimi K2.7 Code (medium) की benchmark लागत कम है: $0.709 vs $0.786. GPT-5.4 Mini (medium) तेज है: 26.72s vs 80.09s, pass rates 63.6% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#114
कुल आउटपुट टोकन
239,546
प्रतिक्रिया समय (औसत)
80.09s
कुल लागत
$0.709
रैंक
#109
कुल आउटपुट टोकन
158,344
प्रतिक्रिया समय (औसत)
26.72s
कुल लागत
$0.786
अनुशंसित मॉडल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 3.0x faster than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 7.4 7.5
रैंक #114 #109
विश्वसनीयता 10.0 10.0
संगति 8.0 8.1
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 68.2%
अस्थिर टेस्ट 5 5
कुल रन 66 66
प्रति परिणाम लागत 7.096 6.546
कुल लागत $0.709 $0.786
इनपुट कीमत $0.710 / 1M $0.750 / 1M
आउटपुट कीमत $3.500 / 1M $4.500 / 1M
कुल इनपुट टोकन 72,085 97,164
आउटपुट टोकन 57,453 6,211
रीजनिंग टोकन 182,093 152,133
प्रतिक्रिया समय (औसत) 80.09s 26.72s
प्रतिक्रिया समय (अधिकतम) 365.80s 138.75s
प्रतिक्रिया समय (कुल) 1681.85s 587.90s
पैरामीटर 1T कुल (32B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#109 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

त्वरित तुलना

तुलना जोड़ी बदलें