नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.7 Code (medium) vs GPT-5.4 Mini (medium)

average score लगभग बराबर है: 7.5 vs 7.5. Kimi K2.7 Code (medium) की benchmark लागत कम है: $0.692 vs $0.756. GPT-5.4 Mini (medium) तेज है: 25.94s vs 84.25s, pass rates 65.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

रैंक
#60
कुल आउटपुट टोकन
262,507
प्रतिक्रिया समय (औसत)
84.25s
कुल लागत
$0.692
रैंक
#64
कुल आउटपुट टोकन
151,755
प्रतिक्रिया समय (औसत)
25.94s
कुल लागत
$0.756
अनुशंसित मॉडल GPT-5.4 Mini (medium)

It has the best score here (7.5), while responding about 3.2x faster than Kimi K2.7 Code (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium रिलीज़: 2026-06-12 GPT-5.4 Mini GPT-5.4 Mini medium रिलीज़: 2026-03-17
स्कोर 7.5 7.5
रैंक #60 #64
विश्वसनीयता 10.0 10.0
संगति 8.3 7.7
सही परीक्षण
प्रति प्रयास पास दर 65.2% 71.2%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 6.457 6.299
कुल लागत $0.692 $0.756
इनपुट कीमत $0.780 / 1M $0.750 / 1M
आउटपुट कीमत $3.500 / 1M $4.500 / 1M
कुल इनपुट टोकन 72,073 97,155
आउटपुट टोकन 83,714 6,211
रीजनिंग टोकन 178,793 145,544
प्रतिक्रिया समय (औसत) 84.25s 25.94s
प्रतिक्रिया समय (अधिकतम) 365.80s 138.75s
प्रतिक्रिया समय (कुल) 1769.22s 570.66s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
लागत
$0.025
समय
138.0s
टोकन
6,093 tok

#64 GPT-5.4 Mini

medium
लागत
$0.056
समय
95.5s
टोकन
12,464 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.4 Mini 8.4 7.4 88.9% 1 57.87s 7,305 467 40,902

त्वरित तुलना

तुलना जोड़ी बदलें