नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Command A+ vs GPT-6 Luna Decisions (default)

Command A+ average score मध्ये पुढे आहे: 3.0 vs 2.4. Command A+ चा benchmark खर्च कमी आहे: $0.000 vs $0.005. GPT-6 Luna Decisions (default) वेगवान आहे: 495ms vs 77.87s, pass rates 0.0% vs 13.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#385
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
77.87s
एकूण खर्च
$0.000
क्रमांक
#390
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
495ms
एकूण खर्च
$0.005
शिफारस केलेले मॉडेल GPT-6 Luna Decisions (default)

Its score stays close to the best score here (2.4 vs 3.0), while responding about 157.3x faster than Command A+.

तपशीलवार तुलना

मेट्रिक Command A+ Command A+ none प्रकाशन: 2026-09-23 GPT-6 Luna Decisions GPT-6 Luna Decisions default प्रकाशन: 2026-10-07
स्कोअर 3.0 2.4
क्रमांक #385 #390
विश्वसनीयता 0.0 10.0
सुसंगतता 10.0 5.2
प्रयत्न 69/69 36/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 0.0% 13.0%
अस्थिर चाचण्या 0 0
एकूण रन 69 36
प्रति निकाल खर्च 0.000 0.159
एकूण खर्च $0.000 $0.005
इनपुट किंमत $0.300 / 1M $0.100 / 1M
आउटपुट किंमत $1.500 / 1M $0.000 / 1M
कॅश वाचण्याची किंमत $0.150 / 1M $0.000 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.000 / 1M
एकूण इनपुट टोकन्स 0 47,583
आउटपुट टोकन्स 0 0
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 77.87s 495ms
प्रतिसाद वेळ (कमाल) 106.37s 842ms
प्रतिसाद वेळ (एकूण) 1791.03s 5.94s
पॅरामीटर्स 218B एकूण (25B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#385 Command A+

none
Provider returned error
खर्च
$0.000
वेळ
0.2s
टोकन्स
0 tok

#390 GPT-6 Luna Decisions

default
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Command A+ 3.0 10.0 0.0% 0 80.82s 0 0 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

झटपट तुलना

तुलना जोडी बदला

Command A+nonevsJev 1.13defaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+nonevsLing 3.0 TinymediumCommand A+nonevsLing 3.0 TinylowCommand A+nonevsLing 3.0 TinyhighCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGranite 4.1 8bdefaultCommand A+nonevsLing 3.0 TinydefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20none