नेविगेशन
Advertise here

Kimi K2.5 (medium) vs GPT-6 Luna (low)

GPT-6 Luna (low) average score में आगे है: 7.0 vs 7.0. GPT-6 Luna (low) की benchmark लागत कम है: $0.020 vs $0.479. GPT-6 Luna (low) तेज है: 21.96s vs 98.19s, pass rates 63.6% vs 62.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#166
कुल आउटपुट टोकन
220,942
प्रतिक्रिया समय (औसत)
98.19s
कुल लागत
$0.479
रैंक
#159
कुल आउटपुट टोकन
22,605
प्रतिक्रिया समय (औसत)
21.96s
कुल लागत
$0.020
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 24.8x less than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.0 7.0
रैंक #166 #159
विश्वसनीयता 10.0 9.6
संगति 7.0 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 62.1%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 4.849 0.176
कुल लागत $0.479 $0.020
इनपुट कीमत $0.450 / 1M $0.100 / 1M
आउटपुट कीमत $2.250 / 1M $0.500 / 1M
कुल इनपुट टोकन 118,496 80,159
आउटपुट टोकन 53,522 4,623
रीजनिंग टोकन 167,420 17,982
प्रतिक्रिया समय (औसत) 98.19s 21.96s
प्रतिक्रिया समय (अधिकतम) 281.00s 89.37s
प्रतिक्रिया समय (कुल) 1571.05s 483.19s
पैरामीटर 1T कुल (32B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#159 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें