नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 vs Qwen3.6 27B

average score लगभग बराबर है: 5.5 vs 5.5. Qwen3.6 27B की benchmark लागत कम है: $0.067 vs $0.127. Qwen3.6 27B तेज है: 10.65s vs 19.15s, pass rates 34.9% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#167
कुल आउटपुट टोकन
26,638
प्रतिक्रिया समय (औसत)
19.15s
कुल लागत
$0.127
रैंक
#164
कुल आउटपुट टोकन
16,155
प्रतिक्रिया समय (औसत)
10.65s
कुल लागत
$0.067
अनुशंसित मॉडल Qwen3.6 27B

It has the best score here (5.5), while costing about 1.9x less than Kimi K2.5.

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 none रिलीज़: 2026-01-27 Qwen3.6 27B Qwen3.6 27B none रिलीज़: 2026-04-20
स्कोर 5.5 5.5
रैंक #167 #164
विश्वसनीयता 10.0 10.0
संगति 8.6 7.6
सही परीक्षण
प्रति प्रयास पास दर 34.9% 45.5%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 1.898 1.220
कुल लागत $0.127 $0.067
इनपुट कीमत $0.571 / 1M $0.290 / 1M
आउटपुट कीमत $2.850 / 1M $2.400 / 1M
कुल इनपुट टोकन 89,322 95,796
आउटपुट टोकन 26,638 16,155
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 19.15s 10.65s
प्रतिक्रिया समय (अधिकतम) 102.83s 156.31s
प्रतिक्रिया समय (कुल) 287.30s 234.39s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 MoonshotAI: Kimi K2.5

none
लागत
$0.015
समय
89.1s
टोकन
5,421 tok

#164 Qwen3.6 27B

none
लागत
$0.009
समय
83.0s
टोकन
4,549 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
Qwen3.6 27B 5.5 10.0 33.3% 0 4.16s 7,913 539 0

त्वरित तुलना

तुलना जोड़ी बदलें