नेविगेशन
AI BENCHY
Advertise here

Kimi K2.5 vs GPT-5.6 Luna

average score लगभग बराबर है: 5.4 vs 5.4. GPT-5.6 Luna की benchmark लागत कम है: $0.029 vs $0.101. GPT-5.6 Luna तेज है: 1.50s vs 18.03s, pass rates 30.3% vs 36.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#223
कुल आउटपुट टोकन
26,643
प्रतिक्रिया समय (औसत)
18.03s
कुल लागत
$0.101
रैंक
#221
कुल आउटपुट टोकन
6,709
प्रतिक्रिया समय (औसत)
1.50s
कुल लागत
$0.029
अनुशंसित मॉडल GPT-5.6 Luna

It has the best score here (5.4), while costing about 3.5x less than Kimi K2.5.

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 none रिलीज़: 2026-01-27 GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09
स्कोर 5.4 5.4
रैंक #223 #221
विश्वसनीयता 10.0 10.0
संगति 8.6 8.8
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 30.3% 36.4%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 2.278 2.357
कुल लागत $0.101 $0.029
इनपुट कीमत $0.450 / 1M $0.200 / 1M
आउटपुट कीमत $2.250 / 1M $1.200 / 1M
कुल इनपुट टोकन 89,320 101,332
आउटपुट टोकन 26,643 6,709
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 18.03s 1.50s
प्रतिक्रिया समय (अधिकतम) 102.83s 10.57s
प्रतिक्रिया समय (कुल) 288.42s 33.05s
पैरामीटर 1T कुल (32B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#223 MoonshotAI: Kimi K2.5

none
लागत
$0.015
समय
89.1s
टोकन
5,421 tok

#221 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

त्वरित तुलना

तुलना जोड़ी बदलें