नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna Decisions (default) vs Grok 4.20

Grok 4.20 average score मध्ये पुढे आहे: 3.4 vs 2.4. GPT-6 Luna Decisions (default) चा benchmark खर्च कमी आहे: $0.005 vs $0.057. GPT-6 Luna Decisions (default) वेगवान आहे: 495ms vs 1.11s, pass rates 13.0% vs 26.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#390
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
495ms
एकूण खर्च
$0.005
क्रमांक
#376
एकूण आउटपुट टोकन्स
1,923
प्रतिसाद वेळ (सरासरी)
1.11s
एकूण खर्च
$0.057
शिफारस केलेले मॉडेल Grok 4.20

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक GPT-6 Luna Decisions GPT-6 Luna Decisions default प्रकाशन: 2026-10-07 Grok 4.20 Grok 4.20 none प्रकाशन: 2026-03-31
स्कोअर 2.4 3.4
क्रमांक #390 #376
विश्वसनीयता 10.0 लागू नाही
सुसंगतता 5.2 7.8
प्रयत्न 36/69 54/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 13.0% 26.1%
अस्थिर चाचण्या 0 0
एकूण रन 36 54
प्रति निकाल खर्च 0.159 1.570
एकूण खर्च $0.005 $0.057
इनपुट किंमत $0.100 / 1M $1.250 / 1M
आउटपुट किंमत $0.000 / 1M $2.500 / 1M
कॅश वाचण्याची किंमत $0.000 / 1M $0.200 / 1M
कॅश लिहिण्याची किंमत $0.000 / 1M लागू नाही
एकूण इनपुट टोकन्स 47,583 41,313
आउटपुट टोकन्स 0 1,923
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 495ms 1.11s
प्रतिसाद वेळ (कमाल) 842ms 6.04s
प्रतिसाद वेळ (एकूण) 5.94s 19.96s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) ~1T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 GPT-6 Luna Decisions

default
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

#376 xAI: Grok 4.20

none
खर्च
$0.004
वेळ
6.5s
टोकन्स
1,367 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

झटपट तुलना

तुलना जोडी बदला

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultQwen3.5-9BmediumvsGrok 4.20none