नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MoonshotAI: Kimi K2.6 vs Qwen: Qwen3.5 Plus 2026-04-20

average score लगभग बराबर है: 7.2 vs 7.2. Qwen3.5 Plus 2026-04-20 (medium) की benchmark लागत कम है: $0.317 vs $1.036. Qwen3.5 Plus 2026-04-20 (medium) तेज है: 46.36s vs 109.98s, pass rates 63.6% vs 63.6%.

अनुशंसित मॉडलQwen3.5 Plus 2026-04-20 (medium)It has the best score here (7.2), while costing about 3.3x less than Kimi K2.6 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium रिलीज़: 2026-04-20
स्कोर 7.2 7.2
रैंक #68 #70
विश्वसनीयता 9.4 9.6
संगति 8.3 9.0
सही परीक्षण
प्रति प्रयास पास दर 63.6% 63.6%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 9.821 3.023
कुल लागत $1.036 $0.317
इनपुट कीमत $0.684 / 1M $0.300 / 1M
आउटपुट कीमत $3.420 / 1M $1.800 / 1M
कुल इनपुट टोकन 68,902 42,097
आउटपुट टोकन 111,680 2,280
रीजनिंग टोकन 279,860 166,613
प्रतिक्रिया समय (औसत) 109.98s 46.36s
प्रतिक्रिया समय (अधिकतम) 876.20s 189.38s
प्रतिक्रिया समय (कुल) 2309.56s 973.57s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

#70 Qwen3.5 Plus 2026-04-20

medium
लागत
$0.008
समय
76.7s
टोकन
4,355 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682

त्वरित तुलना

तुलना जोड़ी बदलें