नेविगेशन
Advertise here

Kimi K2.7 Code (medium) vs GPT-5.2 Chat

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.2 Chat की benchmark लागत कम है: $0.594 vs $0.861. GPT-5.2 Chat तेज है: 7.43s vs 81.18s, pass rates 60.9% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#156
कुल आउटपुट टोकन
259,318
प्रतिक्रिया समय (औसत)
81.18s
कुल लागत
$0.861
रैंक
#153
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.594
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.0), while responding about 10.9x faster than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 7.0 7.0
रैंक #156 #153
विश्वसनीयता 10.0 10.0
संगति 8.1 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 66.7%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 8.755 4.564
कुल लागत $0.861 $0.594
इनपुट कीमत $0.672 / 1M $1.750 / 1M
आउटपुट कीमत $3.350 / 1M $14.000 / 1M
कुल इनपुट टोकन 245,179 101,104
आउटपुट टोकन 62,697 29,742
रीजनिंग टोकन 196,621 0
प्रतिक्रिया समय (औसत) 81.18s 7.43s
प्रतिक्रिया समय (अधिकतम) 365.80s 38.52s
प्रतिक्रिया समय (कुल) 1785.87s 163.35s
पैरामीटर 1T कुल (32B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#156 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#153 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें