नेव्हिगेशन
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.20 (medium)

GPT-5.6 Luna (medium) average score मध्ये पुढे आहे: 7.4 vs 6.3. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.065 vs $1.246. GPT-5.6 Luna (medium) वेगवान आहे: 9.64s vs 36.73s, pass rates 62.3% vs 58.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#122
एकूण आउटपुट टोकन्स
47,986
प्रतिसाद वेळ (सरासरी)
9.64s
एकूण खर्च
$0.065
क्रमांक
#224
एकूण आउटपुट टोकन्स
302,087
प्रतिसाद वेळ (सरासरी)
36.73s
एकूण खर्च
$1.246
शिफारस केलेले मॉडेल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 19.3x less than Grok 4.20 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09 Grok 4.20 Grok 4.20 medium प्रकाशन: 2026-03-31
स्कोअर 7.4 6.3
क्रमांक #122 #224
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 8.2
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 62.3% 58.0%
अस्थिर चाचण्या 3 5
एकूण रन 69 69
प्रति निकाल खर्च 2.822 14.374
एकूण खर्च $0.065 $1.246
इनपुट किंमत $0.200 / 1M $1.250 / 1M
आउटपुट किंमत $1.200 / 1M $2.500 / 1M
कॅश वाचण्याची किंमत $0.020 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत $0.250 / 1M लागू नाही
एकूण इनपुट टोकन्स 212,780 392,127
आउटपुट टोकन्स 6,849 7,754
रिझनिंग टोकन्स 41,137 294,333
प्रतिसाद वेळ (सरासरी) 9.64s 36.73s
प्रतिसाद वेळ (कमाल) 58.09s 199.66s
प्रतिसाद वेळ (एकूण) 221.62s 844.68s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

#224 SpaceXAI: Grok 4.20

medium
खर्च
$0.041
वेळ
110.3s
टोकन्स
16,336 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

झटपट तुलना

तुलना जोडी बदला