नेविगेशन
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Qwen3.7 Max

Kimi K2.7 Code (medium) average score में आगे है: 7.5 vs 7.4. Qwen3.7 Max की benchmark लागत कम है: $0.197 vs $0.692. Qwen3.7 Max तेज है: 4.52s vs 84.25s, pass rates 65.2% vs 68.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
रैंक
#67
कुल आउटपुट टोकन
12,446
प्रतिक्रिया समय (औसत)
4.52s
कुल लागत
$0.197
अनुशंसित मॉडल Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.5), while costing about 3.5x less than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 Qwen3.7 Max Qwen3.7 Max none रिलीज़: 2026-05-22
स्कोर 7.5 7.4
रैंक #60 #67
विश्वसनीयता 10.0 9.9
संगति 8.3 10.0
सही परीक्षण
प्रति प्रयास पास दर 65.2% 68.2%
अस्थिर टेस्ट 4 0
कुल रन 66 66
प्रति परिणाम लागत 6.457 1.582
कुल लागत $0.692 $0.197
इनपुट कीमत $0.780 / 1M $1.475 / 1M
आउटपुट कीमत $3.500 / 1M $4.425 / 1M
कुल इनपुट टोकन 72,073 95,983
आउटपुट टोकन 83,714 12,446
रीजनिंग टोकन 178,793 0
प्रतिक्रिया समय (औसत) 84.25s 4.52s
प्रतिक्रिया समय (अधिकतम) 365.80s 72.30s
प्रतिक्रिया समय (कुल) 1769.22s 99.52s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#67 Qwen3.7 Max

none
लागत
$0.046
समय
195.0s
टोकन
12,171 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0

त्वरित तुलना

तुलना जोड़ी बदलें