नेव्हिगेशन
Advertise here

GPT-6 Luna (medium) vs Grok 4.5 (high)

average score जवळपास समान आहे: 8.3 vs 8.2. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $2.571. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 72.50s, pass rates 73.9% vs 82.6%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
क्रमांक
#82
एकूण आउटपुट टोकन्स
333,632
प्रतिसाद वेळ (सरासरी)
72.50s
एकूण खर्च
$2.571
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 54.8x less than Grok 4.5 (high).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23 Grok 4.5 Grok 4.5 high प्रकाशन: 2026-07-08
स्कोअर 8.3 8.2
क्रमांक #79 #82
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 8.9
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 82.6%
अस्थिर चाचण्या 3 3
एकूण रन 69 69
प्रति निकाल खर्च 0.313 15.123
एकूण खर्च $0.047 $2.571
इनपुट किंमत $0.100 / 1M $2.000 / 1M
आउटपुट किंमत $0.500 / 1M $6.000 / 1M
एकूण इनपुट टोकन्स 203,193 342,124
आउटपुट टोकन्स 5,751 7,135
रिझनिंग टोकन्स 47,410 326,497
प्रतिसाद वेळ (सरासरी) 18.07s 72.50s
प्रतिसाद वेळ (कमाल) 66.44s 676.83s
प्रतिसाद वेळ (एकूण) 415.53s 1667.51s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1.7T एकूण (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

#82 SpaceXAI: Grok 4.5

high
खर्च
$0.015
वेळ
29.7s
टोकन्स
2,737 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

झटपट तुलना

तुलना जोडी बदला