नेविगेशन
Advertise here

Kimi K2.5 (medium) vs Qwen3.5-122B-A10B

average score लगभग बराबर है: 6.4 vs 6.4. Qwen3.5-122B-A10B की benchmark लागत कम है: $0.308 vs $0.603. Qwen3.5-122B-A10B तेज है: 14.79s vs 125.76s, pass rates 60.9% vs 36.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#206
कुल आउटपुट टोकन
241,096
प्रतिक्रिया समय (औसत)
125.76s
कुल लागत
$0.603
रैंक
#201
कुल आउटपुट टोकन
97,112
प्रतिक्रिया समय (औसत)
14.79s
कुल लागत
$0.308
अनुशंसित मॉडल Qwen3.5-122B-A10B

It has the best score here (6.4), while costing about 2.0x less than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none रिलीज़: 2026-02-24
स्कोर 6.4 6.4
रैंक #206 #201
विश्वसनीयता 9.6 10.0
संगति 7.1 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 36.2%
अस्थिर टेस्ट 8 2
कुल रन 69 69
प्रति परिणाम लागत 6.085 4.452
कुल लागत $0.603 $0.308
इनपुट कीमत $0.450 / 1M $0.260 / 1M
आउटपुट कीमत $2.250 / 1M $2.080 / 1M
कुल इनपुट टोकन 292,271 405,921
आउटपुट टोकन 55,025 97,112
रीजनिंग टोकन 186,071 0
प्रतिक्रिया समय (औसत) 125.76s 14.79s
प्रतिक्रिया समय (अधिकतम) 566.79s 212.63s
प्रतिक्रिया समय (कुल) 2137.84s 340.25s
पैरामीटर 1T कुल (32B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#206 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#201 Qwen3.5-122B-A10B

none
लागत
$0.016
समय
44.5s
टोकन
6,431 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

त्वरित तुलना

तुलना जोड़ी बदलें