नेविगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs GPT-5.6 Terra (low)

GPT-5.6 Terra (low) average score में आगे है: 7.5 vs 7.4. GPT-5.6 Terra (low) की benchmark लागत कम है: $0.420 vs $0.687. GPT-5.6 Terra (low) तेज है: 5.45s vs 80.09s, pass rates 63.6% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#96
कुल आउटपुट टोकन
239,546
प्रतिक्रिया समय (औसत)
80.09s
कुल लागत
$0.687
रैंक
#86
कुल आउटपुट टोकन
21,586
प्रतिक्रिया समय (औसत)
5.45s
कुल लागत
$0.420
अनुशंसित मॉडल GPT-5.6 Terra (low)

It has the best score here (7.5), while costing about 1.6x less than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT-5.6 Terra GPT-5.6 Terra low रिलीज़: 2026-07-09
स्कोर 7.4 7.5
रैंक #96 #86
विश्वसनीयता 10.0 10.0
संगति 8.0 7.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 74.2%
अस्थिर टेस्ट 5 6
कुल रन 66 66
प्रति परिणाम लागत 7.096 3.954
कुल लागत $0.687 $0.420
इनपुट कीमत $0.660 / 1M $2.000 / 1M
आउटपुट कीमत $3.400 / 1M $12.000 / 1M
कुल इनपुट टोकन 72,085 80,304
आउटपुट टोकन 57,453 4,714
रीजनिंग टोकन 182,093 16,872
प्रतिक्रिया समय (औसत) 80.09s 5.45s
प्रतिक्रिया समय (अधिकतम) 365.80s 19.85s
प्रतिक्रिया समय (कुल) 1681.85s 119.83s
पैरामीटर 1T कुल (32B सक्रिय) ~1T कुल (~60B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#86 GPT-5.6 Terra

low
लागत
$0.034
समय
16.8s
टोकन
2,348 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Terra 6.6 4.6 77.8% 2 9.56s 7,302 429 6,821

त्वरित तुलना

तुलना जोड़ी बदलें