नेव्हिगेशन
AI BENCHY
Advertise here

Kimi K2.5 vs GPT-5.6 Luna

average score जवळपास समान आहे: 5.4 vs 5.4. GPT-5.6 Luna चा benchmark खर्च कमी आहे: $0.029 vs $0.101. GPT-5.6 Luna वेगवान आहे: 1.50s vs 18.03s, pass rates 30.3% vs 36.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#223
एकूण आउटपुट टोकन्स
26,643
प्रतिसाद वेळ (सरासरी)
18.03s
एकूण खर्च
$0.101
क्रमांक
#221
एकूण आउटपुट टोकन्स
6,709
प्रतिसाद वेळ (सरासरी)
1.50s
एकूण खर्च
$0.029
शिफारस केलेले मॉडेल GPT-5.6 Luna

It has the best score here (5.4), while costing about 3.5x less than Kimi K2.5.

तपशीलवार तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 none प्रकाशन: 2026-01-27 GPT-5.6 Luna GPT-5.6 Luna none प्रकाशन: 2026-07-09
स्कोअर 5.4 5.4
क्रमांक #223 #221
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.8
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 30.3% 36.4%
अस्थिर चाचण्या 4 3
एकूण रन 66 66
प्रति निकाल खर्च 2.278 2.357
एकूण खर्च $0.101 $0.029
इनपुट किंमत $0.450 / 1M $0.200 / 1M
आउटपुट किंमत $2.250 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 89,320 101,332
आउटपुट टोकन्स 26,643 6,709
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 18.03s 1.50s
प्रतिसाद वेळ (कमाल) 102.83s 10.57s
प्रतिसाद वेळ (एकूण) 288.42s 33.05s
पॅरामीटर्स 1T एकूण (32B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता वेट्स उपलब्ध बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#223 MoonshotAI: Kimi K2.5

none
खर्च
$0.015
वेळ
89.1s
टोकन्स
5,421 tok

#221 GPT-5.6 Luna

none
खर्च
$0.016
वेळ
15.8s
टोकन्स
2,685 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

झटपट तुलना

तुलना जोडी बदला