नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 vs GPT-5.6 Luna

average score जवळपास समान आहे: 5.3 vs 5.3. GPT-5.6 Luna चा benchmark खर्च कमी आहे: $0.042 vs $0.262. GPT-5.6 Luna वेगवान आहे: 3.78s vs 35.86s, pass rates 29.0% vs 34.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#299
एकूण आउटपुट टोकन्स
49,389
प्रतिसाद वेळ (सरासरी)
35.86s
एकूण खर्च
$0.262
क्रमांक
#297
एकूण आउटपुट टोकन्स
8,000
प्रतिसाद वेळ (सरासरी)
3.78s
एकूण खर्च
$0.042
शिफारस केलेले मॉडेल GPT-5.6 Luna

It has the best score here (5.3), while costing about 6.3x less than Kimi K2.5.

तपशीलवार तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 none प्रकाशन: 2026-01-27 GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09
स्कोअर 5.3 5.3
क्रमांक #299 #297
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.8
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 29.0% 34.8%
अस्थिर चाचण्या 4 3
एकूण रन 69 69
प्रति निकाल खर्च 4.976 2.814
एकूण खर्च $0.262 $0.042
इनपुट किंमत $0.450 / 1M $0.200 / 1M
आउटपुट किंमत $2.250 / 1M $1.200 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.020 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.250 / 1M
एकूण इनपुट टोकन्स 275,349 230,744
आउटपुट टोकन्स 49,377 8,000
रिझनिंग टोकन्स 12 0
प्रतिसाद वेळ (सरासरी) 35.86s 3.78s
प्रतिसाद वेळ (कमाल) 321.19s 53.77s
प्रतिसाद वेळ (एकूण) 609.61s 86.83s
पॅरामीटर्स 1T एकूण (32B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#299 MoonshotAI: Kimi K2.5

none
खर्च
$0.015
वेळ
89.1s
टोकन्स
5,421 tok

#297 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

तुलना जोडी बदला