नेव्हिगेशन
Advertise here

GPT-6 Luna (low) vs Grok 4.3 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-6 Luna (low) चा benchmark खर्च कमी आहे: $0.020 vs $0.741. GPT-6 Luna (low) वेगवान आहे: 21.96s vs 44.21s, pass rates 62.1% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-23

तुलना केलेली मॉडेल्स

क्रमांक
#159
एकूण आउटपुट टोकन्स
22,605
प्रतिसाद वेळ (सरासरी)
21.96s
एकूण खर्च
$0.020
क्रमांक
#157
एकूण आउटपुट टोकन्स
225,904
प्रतिसाद वेळ (सरासरी)
44.21s
एकूण खर्च
$0.741
शिफारस केलेले मॉडेल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 38.3x less than Grok 4.3 (medium).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna low प्रकाशन: 2026-09-23 Grok 4.3 Grok 4.3 medium प्रकाशन: 2026-05-01
स्कोअर 7.0 7.0
क्रमांक #159 #157
विश्वसनीयता 9.6 10.0
सुसंगतता 8.5 8.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 62.1% 66.7%
अस्थिर चाचण्या 4 5
एकूण रन 66 66
प्रति निकाल खर्च 0.176 6.168
एकूण खर्च $0.020 $0.741
इनपुट किंमत $0.100 / 1M $1.250 / 1M
आउटपुट किंमत $0.500 / 1M $2.500 / 1M
एकूण इनपुट टोकन्स 80,159 140,244
आउटपुट टोकन्स 4,623 13,739
रिझनिंग टोकन्स 17,982 212,165
प्रतिसाद वेळ (सरासरी) 21.96s 44.21s
प्रतिसाद वेळ (कमाल) 89.37s 216.69s
प्रतिसाद वेळ (एकूण) 483.19s 972.64s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1.5T एकूण (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#159 GPT-6 Luna

low
खर्च
$0.002
वेळ
19.2s
टोकन्स
2,598 tok

#157 SpaceXAI: Grok 4.3

medium
खर्च
$0.009
वेळ
19.0s
टोकन्स
3,661 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

झटपट तुलना

तुलना जोडी बदला