नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs GPT-6 Luna (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 6.4. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $0.841. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 125.76s, pass rates 60.9% vs 73.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-03

तुलना केलेली मॉडेल्स

क्रमांक
#208
एकूण आउटपुट टोकन्स
241,096
प्रतिसाद वेळ (सरासरी)
125.76s
एकूण खर्च
$0.841
क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 17.9x less than Kimi K2.5 (medium).

तपशीलवार तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium प्रकाशन: 2026-01-27 GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23
स्कोअर 6.4 8.3
क्रमांक #208 #79
विश्वसनीयता 9.6 10.0
सुसंगतता 7.1 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.9% 73.9%
अस्थिर चाचण्या 8 3
एकूण रन 69 69
प्रति निकाल खर्च 6.085 0.313
एकूण खर्च $0.841 $0.047
इनपुट किंमत $0.450 / 1M $0.100 / 1M
आउटपुट किंमत $2.250 / 1M $0.500 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.010 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.125 / 1M
एकूण इनपुट टोकन्स 292,271 203,193
आउटपुट टोकन्स 55,025 5,751
रिझनिंग टोकन्स 186,071 47,410
प्रतिसाद वेळ (सरासरी) 125.76s 18.07s
प्रतिसाद वेळ (कमाल) 566.79s 66.44s
प्रतिसाद वेळ (एकूण) 2137.84s 415.53s
पॅरामीटर्स 1T एकूण (32B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 MoonshotAI: Kimi K2.5

medium
खर्च
$0.030
वेळ
58.6s
टोकन्स
8,683 tok

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

झटपट तुलना

तुलना जोडी बदला