नेविगेशन
AI BENCHY
Advertise here

Kimi K2.6 vs Qwen3.5-122B-A10B

average score लगभग बराबर है: 5.7 vs 5.7. Kimi K2.6 की benchmark लागत कम है: $0.233 vs $0.247. Qwen3.5-122B-A10B तेज है: 12.93s vs 19.57s, pass rates 30.3% vs 33.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-26

रैंक
#206
कुल आउटपुट टोकन
30,249
प्रतिक्रिया समय (औसत)
19.57s
कुल लागत
$0.233
रैंक
#207
कुल आउटपुट टोकन
88,459
प्रतिक्रिया समय (औसत)
12.93s
कुल लागत
$0.247
अनुशंसित मॉडल Qwen3.5-122B-A10B

It has the best score here (5.7), while responding about 1.5x faster than Kimi K2.6.

विस्तृत तुलना

मेट्रिक Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20 Qwen3.5-122B-A10B Qwen3.5-122B-A10B none रिलीज़: 2026-02-24
स्कोर 5.7 5.7
रैंक #206 #207
विश्वसनीयता 10.0 10.0
संगति 9.3 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 30.3% 33.3%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 3.732 4.182
कुल लागत $0.233 $0.247
इनपुट कीमत $0.950 / 1M $0.260 / 1M
आउटपुट कीमत $4.000 / 1M $2.080 / 1M
कुल इनपुट टोकन 116,983 241,575
आउटपुट टोकन 30,249 88,459
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 19.57s 12.93s
प्रतिक्रिया समय (अधिकतम) 238.89s 212.63s
प्रतिक्रिया समय (कुल) 430.58s 284.39s
पैरामीटर 1T कुल (32B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#206 MoonshotAI: Kimi K2.6

none
लागत
$0.020
समय
127.4s
टोकन
4,429 tok

#207 Qwen3.5-122B-A10B

none
लागत
$0.016
समय
44.5s
टोकन
6,431 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
Qwen3.5-122B-A10B 3.7 7.0 22.2% 1 2.77s 7,913 693 0

त्वरित तुलना

तुलना जोड़ी बदलें