नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.7 Code (medium) vs Qwen3.5-122B-A10B (medium)

average score लगभग बराबर है: 7.0 vs 7.0. Kimi K2.7 Code (medium) की benchmark लागत कम है: $1.136 vs $1.152. Qwen3.5-122B-A10B (medium) तेज है: 66.96s vs 81.18s, pass rates 60.9% vs 71.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-09

तुलना किए गए मॉडल

रैंक
#167
कुल आउटपुट टोकन
207,661
प्रतिक्रिया समय (औसत)
81.18s
कुल लागत
$1.136
रैंक
#170
कुल आउटपुट टोकन
522,190
प्रतिक्रिया समय (औसत)
66.96s
कुल लागत
$1.152
अनुशंसित मॉडल Qwen3.5-122B-A10B (medium)

इस तुलना में इसका स्कोर सबसे अधिक है (7.0) और 2 मॉडलों में लागत और प्रतिक्रिया समय का समग्र संतुलन सबसे अच्छा है।

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium रिलीज़: 2026-02-24
स्कोर 7.0 7.0
रैंक #167 #170
विश्वसनीयता 10.0 10.0
संगति 8.1 8.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 71.0%
अस्थिर टेस्ट 5 5
कुल रन 69 69
प्रति परिणाम लागत 8.755 9.196
कुल लागत $1.136 $1.152
इनपुट कीमत $0.672 / 1M $0.260 / 1M
आउटपुट कीमत $3.350 / 1M $2.080 / 1M
कैश पढ़ने की कीमत $0.180 / 1M लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 245,179 251,695
आउटपुट टोकन 62,697 49,415
रीजनिंग टोकन 196,621 472,775
प्रतिक्रिया समय (औसत) 81.18s 66.96s
प्रतिक्रिया समय (अधिकतम) 365.80s 519.30s
प्रतिक्रिया समय (कुल) 1785.87s 1539.99s
पैरामीटर 1T कुल (32B सक्रिय) 122B कुल (10B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#170 Qwen3.5-122B-A10B

medium
लागत
$0.019
समय
48.7s
टोकन
6,034 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

तुलना जोड़ी बदलें