नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs Kimi K2.7 Code (medium)

average score लगभग बराबर है: 7.4 vs 7.4. LongCat 2.0 (medium) की benchmark लागत कम है: $0.499 vs $0.709. Kimi K2.7 Code (medium) तेज है: 80.09s vs 143.55s, pass rates 59.1% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#94
कुल आउटपुट टोकन
390,873
प्रतिक्रिया समय (औसत)
143.55s
कुल लागत
$0.499
रैंक
#92
कुल आउटपुट टोकन
239,546
प्रतिक्रिया समय (औसत)
80.09s
कुल लागत
$0.709
अनुशंसित मॉडल Kimi K2.7 Code (medium)

It has the best score here (7.4), while responding about 1.8x faster than LongCat 2.0 (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12
स्कोर 7.4 7.4
रैंक #94 #92
विश्वसनीयता 10.0 10.0
संगति 9.3 8.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 63.6%
अस्थिर टेस्ट 2 5
कुल रन 66 66
प्रति परिणाम लागत 4.153 7.096
कुल लागत $0.499 $0.709
इनपुट कीमत $0.300 / 1M $0.710 / 1M
आउटपुट कीमत $1.200 / 1M $3.500 / 1M
कुल इनपुट टोकन 97,324 72,085
आउटपुट टोकन 44,383 57,453
रीजनिंग टोकन 346,490 182,093
प्रतिक्रिया समय (औसत) 143.55s 80.09s
प्रतिक्रिया समय (अधिकतम) 939.52s 365.80s
प्रतिक्रिया समय (कुल) 3158.11s 1681.85s
पैरामीटर 1.6T कुल (48B सक्रिय) 1T कुल (32B सक्रिय)
उपलब्धता मुक्त स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#92 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635

त्वरित तुलना

तुलना जोड़ी बदलें