नेविगेशन
Advertise here

Claude Sonnet 5.5 (low) vs Kimi K2.6 (medium)

average score लगभग बराबर है: 6.9 vs 6.8. Claude Sonnet 5.5 (low) की benchmark लागत कम है: $0.909 vs $1.323. Claude Sonnet 5.5 (low) तेज है: 7.46s vs 121.25s, pass rates 46.4% vs 60.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#166
कुल आउटपुट टोकन
32,443
प्रतिक्रिया समय (औसत)
7.46s
कुल लागत
$0.909
रैंक
#168
कुल आउटपुट टोकन
396,671
प्रतिक्रिया समय (औसत)
121.25s
कुल लागत
$1.323
अनुशंसित मॉडल Claude Sonnet 5.5 (low)

It has the best score here (6.9), while responding about 16.3x faster than Kimi K2.6 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 low रिलीज़: 2026-09-29 Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20
स्कोर 6.9 6.8
रैंक #166 #168
विश्वसनीयता 10.0 10.0
संगति 9.4 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 46.4% 60.9%
अस्थिर टेस्ट 2 4
कुल रन 69 69
प्रति परिणाम लागत 9.082 12.282
कुल लागत $0.909 $1.323
इनपुट कीमत $2.000 / 1M $0.650 / 1M
आउटपुट कीमत $10.000 / 1M $3.410 / 1M
कुल इनपुट टोकन 291,853 226,880
आउटपुट टोकन 24,116 65,346
रीजनिंग टोकन 8,327 331,325
प्रतिक्रिया समय (औसत) 7.46s 121.25s
प्रतिक्रिया समय (अधिकतम) 46.61s 876.20s
प्रतिक्रिया समय (कुल) 171.47s 2667.55s
पैरामीटर ~1T कुल (~100B सक्रिय) 1T कुल (32B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Claude Sonnet 5.5

low
लागत
$0.020
समय
15.3s
टोकन
2,077 tok

#168 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189

त्वरित तुलना

तुलना जोड़ी बदलें