नेव्हिगेशन
Advertise here

Command A+ (medium) vs GPT-6 Luna Decisions (default)

Command A+ (medium) average score मध्ये पुढे आहे: 3.4 vs 2.4. GPT-6 Luna Decisions (default) चा benchmark खर्च कमी आहे: $0.005 vs $0.064. GPT-6 Luna Decisions (default) वेगवान आहे: 495ms vs 91.72s, pass rates 0.0% vs 13.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-07

तुलना केलेली मॉडेल्स

क्रमांक
#377
एकूण आउटपुट टोकन्स
18,795
प्रतिसाद वेळ (सरासरी)
91.72s
एकूण खर्च
$0.064
क्रमांक
#390
एकूण आउटपुट टोकन्स
0
प्रतिसाद वेळ (सरासरी)
495ms
एकूण खर्च
$0.005
शिफारस केलेले मॉडेल Command A+ (medium)

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

तपशीलवार तुलना

मेट्रिक Command A+ Command A+ medium प्रकाशन: 2026-09-23 GPT-6 Luna Decisions GPT-6 Luna Decisions default प्रकाशन: 2026-10-07
स्कोअर 3.4 2.4
क्रमांक #377 #390
विश्वसनीयता 3.5 10.0
सुसंगतता 10.0 5.2
प्रयत्न 69/69 36/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 0.0% 13.0%
अस्थिर चाचण्या 0 0
एकूण रन 69 36
प्रति निकाल खर्च 0.000 0.159
एकूण खर्च $0.064 $0.005
इनपुट किंमत $0.300 / 1M $0.100 / 1M
आउटपुट किंमत $1.500 / 1M $0.000 / 1M
कॅश वाचण्याची किंमत $0.150 / 1M $0.000 / 1M
कॅश लिहिण्याची किंमत लागू नाही $0.000 / 1M
एकूण इनपुट टोकन्स 118,771 47,583
आउटपुट टोकन्स 4,127 0
रिझनिंग टोकन्स 14,668 0
प्रतिसाद वेळ (सरासरी) 91.72s 495ms
प्रतिसाद वेळ (कमाल) 112.76s 842ms
प्रतिसाद वेळ (एकूण) 2109.54s 5.94s
पॅरामीटर्स 218B एकूण (25B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#377 Command A+

medium
Provider returned error
खर्च
$0.000
वेळ
0.2s
टोकन्स
0 tok

#390 GPT-6 Luna Decisions

default
या मॉडेलसाठी अद्याप कोणताही शोकेस निकाल तयार झालेला नाही.
खर्च
लागू नाही
वेळ
-
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Command A+ 3.0 10.0 0.0% 0 93.13s 0 0 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

झटपट तुलना

तुलना जोडी बदला

Command A+mediumvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinylowCommand A+mediumvsLing 3.0 TinyhighCommand A+mediumvsNemotron 3.5 Lightningnoneमोफत उपलब्धCommand A+mediumvsGranite 4.1 8bdefaultCommand A+mediumvsLing 3.0 TinydefaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+mediumvsMercury 2.5noneCommand A+mediumvsJev 1.13default