नेविगेशन
Advertise here

Kimi K2.7 Code (medium) vs GPT 5.3 Chat

average score लगभग बराबर है: 7.4 vs 7.5. GPT 5.3 Chat की benchmark लागत कम है: $0.533 vs $0.709. GPT 5.3 Chat तेज है: 6.56s vs 80.09s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#114
कुल आउटपुट टोकन
239,546
प्रतिक्रिया समय (औसत)
80.09s
कुल लागत
$0.709
रैंक
#105
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (7.5), while responding about 12.2x faster than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.4 7.5
रैंक #114 #105
विश्वसनीयता 10.0 10.0
संगति 8.0 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 7.096 4.097
कुल लागत $0.709 $0.533
इनपुट कीमत $0.710 / 1M $1.750 / 1M
आउटपुट कीमत $3.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 72,085 78,846
आउटपुट टोकन 57,453 28,179
रीजनिंग टोकन 182,093 0
प्रतिक्रिया समय (औसत) 80.09s 6.56s
प्रतिक्रिया समय (अधिकतम) 365.80s 18.33s
प्रतिक्रिया समय (कुल) 1681.85s 137.77s
पैरामीटर 1T कुल (32B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#105 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें