नेव्हिगेशन
AI BENCHY
Advertise here

MoonshotAI: Kimi K2.7 Code vs OpenAI: GPT-5.6 Luna

average score जवळपास समान आहे: 7.5 vs 7.6. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.352 vs $0.692. GPT-5.6 Luna (medium) वेगवान आहे: 7.28s vs 84.25s, pass rates 65.2% vs 65.2%.

शिफारस केलेले मॉडेलGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 2.0x less than Kimi K2.7 Code (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

तुलना सारांश

क्रमांक
#60
एकूण आउटपुट टोकन्स
262,507
प्रतिसाद वेळ (सरासरी)
84.25s
एकूण खर्च
$0.692
क्रमांक
#57
एकूण आउटपुट टोकन्स
43,679
प्रतिसाद वेळ (सरासरी)
7.28s
एकूण खर्च
$0.352

तपशीलवार तुलना

मेट्रिक Kimi K2.7 Code Kimi K2.7 Code medium प्रकाशन: 2026-06-12 GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09
स्कोअर 7.5 7.6
क्रमांक #60 #57
विश्वसनीयता 10.0 10.0
सुसंगतता 8.3 9.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 65.2%
अस्थिर चाचण्या 4 1
एकूण रन 66 66
प्रति निकाल खर्च 6.457 2.513
एकूण खर्च $0.692 $0.352
इनपुट किंमत $0.780 / 1M $1.000 / 1M
आउटपुट किंमत $3.500 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 72,073 89,676
आउटपुट टोकन्स 83,714 5,699
रिझनिंग टोकन्स 178,793 37,980
प्रतिसाद वेळ (सरासरी) 84.25s 7.28s
प्रतिसाद वेळ (कमाल) 365.80s 29.85s
प्रतिसाद वेळ (एकूण) 1769.22s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
खर्च
$0.025
वेळ
138.0s
टोकन्स
6,093 tok

#57 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

झटपट तुलना

तुलना जोडी बदला