नेविगेशन
Advertise here

Kimi K3 (max) vs GPT-6 Luna (medium)

average score लगभग बराबर है: 7.9 vs 7.9. GPT-6 Luna (medium) की benchmark लागत कम है: $0.031 vs $3.467. GPT-6 Luna (medium) तेज है: 15.87s vs 142.84s, pass rates 77.3% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#90
कुल आउटपुट टोकन
224,128
प्रतिक्रिया समय (औसत)
142.84s
कुल लागत
$3.467
रैंक
#94
कुल आउटपुट टोकन
45,154
प्रतिक्रिया समय (औसत)
15.87s
कुल लागत
$0.031
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 113.8x less than Kimi K3 (max).

विस्तृत तुलना

मेट्रिक Kimi K3 Kimi K3 max रिलीज़: 2026-07-16 GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23
स्कोर 7.9 7.9
रैंक #90 #94
विश्वसनीयता 9.0 10.0
संगति 9.2 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 77.3% 72.7%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 21.668 0.218
कुल लागत $3.467 $0.031
इनपुट कीमत $3.000 / 1M $0.100 / 1M
आउटपुट कीमत $15.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 34,960 78,946
आउटपुट टोकन 2,887 4,635
रीजनिंग टोकन 221,241 40,519
प्रतिक्रिया समय (औसत) 142.84s 15.87s
प्रतिक्रिया समय (अधिकतम) 766.58s 35.14s
प्रतिक्रिया समय (कुल) 2714.02s 349.09s
पैरामीटर 2.8T कुल (104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 MoonshotAI: Kimi K3

max
लागत
$0.281
समय
506.9s
टोकन
18,863 tok

#94 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K3 10.0 10.0 100.0% 0 325.79s 8,061 460 84,012
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

त्वरित तुलना

तुलना जोड़ी बदलें