नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna (medium) vs Grok Build 0.1 (medium)

GPT-6 Luna (medium) average score मध्ये पुढे आहे: 8.3 vs 6.7. GPT-6 Luna (medium) चा benchmark खर्च कमी आहे: $0.047 vs $1.419. GPT-6 Luna (medium) वेगवान आहे: 18.07s vs 55.13s, pass rates 73.9% vs 58.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-03

तुलना केलेली मॉडेल्स

क्रमांक
#79
एकूण आउटपुट टोकन्स
53,161
प्रतिसाद वेळ (सरासरी)
18.07s
एकूण खर्च
$0.047
क्रमांक
#178
एकूण आउटपुट टोकन्स
529,806
प्रतिसाद वेळ (सरासरी)
55.13s
एकूण खर्च
$1.419
शिफारस केलेले मॉडेल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 30.2x less than Grok Build 0.1 (medium).

तपशीलवार तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium प्रकाशन: 2026-09-23 Grok Build 0.1 Grok Build 0.1 medium प्रकाशन: 2026-05-21
स्कोअर 8.3 6.7
क्रमांक #79 #178
विश्वसनीयता 10.0 10.0
सुसंगतता 8.9 9.6
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.9% 58.0%
अस्थिर चाचण्या 3 1
एकूण रन 69 69
प्रति निकाल खर्च 0.313 10.910
एकूण खर्च $0.047 $1.419
इनपुट किंमत $0.100 / 1M $1.000 / 1M
आउटपुट किंमत $0.500 / 1M $2.000 / 1M
कॅश वाचण्याची किंमत $0.010 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत $0.125 / 1M लागू नाही
एकूण इनपुट टोकन्स 203,193 358,616
आउटपुट टोकन्स 5,751 9,651
रिझनिंग टोकन्स 47,410 520,155
प्रतिसाद वेळ (सरासरी) 18.07s 55.13s
प्रतिसाद वेळ (कमाल) 66.44s 252.69s
प्रतिसाद वेळ (एकूण) 415.53s 1268.10s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~300B एकूण (~30B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 GPT-6 Luna

medium
खर्च
$0.002
वेळ
23.6s
टोकन्स
2,966 tok

#178 SpaceXAI: Grok Build 0.1

medium
खर्च
$0.028
वेळ
81.3s
टोकन्स
14,009 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

झटपट तुलना

तुलना जोडी बदला