नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 4.8 vs Kimi K2.7 Code (medium)

Kimi K2.7 Code (medium) average score में आगे है: 7.5 vs 7.3. Kimi K2.7 Code (medium) की benchmark लागत कम है: $0.692 vs $1.166. Claude Opus 4.8 तेज है: 4.91s vs 84.25s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#74
कुल आउटपुट टोकन
16,797
प्रतिक्रिया समय (औसत)
4.91s
कुल लागत
$1.166
रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
अनुशंसित मॉडल Claude Opus 4.8

Its score stays close to the best score here (7.3 vs 7.5), while responding about 17.2x faster than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12
स्कोर 7.3 7.5
रैंक #74 #60
विश्वसनीयता 10.0 10.0
संगति 9.2 8.3
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 8.969 6.457
कुल लागत $1.166 $0.692
इनपुट कीमत $5.000 / 1M $0.780 / 1M
आउटपुट कीमत $25.000 / 1M $3.500 / 1M
कुल इनपुट टोकन 149,206 72,073
आउटपुट टोकन 16,797 83,714
रीजनिंग टोकन 0 178,793
प्रतिक्रिया समय (औसत) 4.91s 84.25s
प्रतिक्रिया समय (अधिकतम) 35.03s 365.80s
प्रतिक्रिया समय (कुल) 108.03s 1769.22s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
लागत
$0.053
समय
22.0s
टोकन
2,253 tok

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635

त्वरित तुलना

तुलना जोड़ी बदलें