नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs GPT-5.5

average score लगभग बराबर है: 7.0 vs 7.0. Kimi K2.5 (medium) की benchmark लागत कम है: $0.479 vs $0.544. GPT-5.5 तेज है: 2.35s vs 98.19s, pass rates 63.6% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-04

रैंक
#139
कुल आउटपुट टोकन
220,942
प्रतिक्रिया समय (औसत)
98.19s
कुल लागत
$0.479
रैंक
#135
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while responding about 41.7x faster than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 7.0 7.0
रैंक #139 #135
विश्वसनीयता 10.0 10.0
संगति 7.0 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 59.1%
अस्थिर टेस्ट 8 2
कुल रन 66 66
प्रति परिणाम लागत 4.849 4.533
कुल लागत $0.479 $0.544
इनपुट कीमत $0.450 / 1M $5.000 / 1M
आउटपुट कीमत $2.250 / 1M $30.000 / 1M
कुल इनपुट टोकन 118,496 79,294
आउटपुट टोकन 53,522 4,915
रीजनिंग टोकन 167,420 0
प्रतिक्रिया समय (औसत) 98.19s 2.35s
प्रतिक्रिया समय (अधिकतम) 281.00s 12.24s
प्रतिक्रिया समय (कुल) 1571.05s 51.78s
पैरामीटर 1T कुल (32B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#135 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें