नेविगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Qwen3.5 Plus 2026-02-15 (medium)

Kimi K2.7 Code (medium) average score में आगे है: 7.5 vs 7.5. Qwen3.5 Plus 2026-02-15 (medium) की benchmark लागत कम है: $0.437 vs $0.692. Kimi K2.7 Code (medium) तेज है: 84.25s vs 89.19s, pass rates 65.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
रैंक
#65
कुल आउटपुट टोकन
260,704
प्रतिक्रिया समय (औसत)
89.19s
कुल लागत
$0.437
अनुशंसित मॉडल Qwen3.5 Plus 2026-02-15 (medium)

Its score stays close to the best score here (7.5 vs 7.5), while costing about 1.6x less than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15
स्कोर 7.5 7.5
रैंक #60 #65
विश्वसनीयता 10.0 10.0
संगति 8.3 8.5
सही परीक्षण
प्रति प्रयास पास दर 65.2% 71.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 6.457 3.348
कुल लागत $0.692 $0.437
इनपुट कीमत $0.780 / 1M $0.260 / 1M
आउटपुट कीमत $3.500 / 1M $1.560 / 1M
कुल इनपुट टोकन 72,073 113,560
आउटपुट टोकन 83,714 9,823
रीजनिंग टोकन 178,793 250,881
प्रतिक्रिया समय (औसत) 84.25s 89.19s
प्रतिक्रिया समय (अधिकतम) 365.80s 304.85s
प्रतिक्रिया समय (कुल) 1769.22s 1337.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#65 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

त्वरित तुलना

तुलना जोड़ी बदलें