नेविगेशन
Advertise here

Command A+ (medium) vs GPT-6 Luna Decisions (default)

Command A+ (medium) average score में आगे है: 3.4 vs 2.4. GPT-6 Luna Decisions (default) की benchmark लागत कम है: $0.005 vs $0.064. GPT-6 Luna Decisions (default) तेज है: 495ms vs 91.72s, pass rates 0.0% vs 13.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#377
कुल आउटपुट टोकन
18,795
प्रतिक्रिया समय (औसत)
91.72s
कुल लागत
$0.064
रैंक
#390
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
495ms
कुल लागत
$0.005
अनुशंसित मॉडल Command A+ (medium)

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Command A+ Command A+ medium रिलीज़: 2026-09-23 GPT-6 Luna Decisions GPT-6 Luna Decisions default रिलीज़: 2026-10-07
स्कोर 3.4 2.4
रैंक #377 #390
विश्वसनीयता 3.5 10.0
संगति 10.0 5.2
प्रयास 69/69 36/69
सही परीक्षण
प्रति प्रयास पास दर 0.0% 13.0%
अस्थिर टेस्ट 0 0
कुल रन 69 36
प्रति परिणाम लागत 0.000 0.159
कुल लागत $0.064 $0.005
इनपुट कीमत $0.300 / 1M $0.100 / 1M
आउटपुट कीमत $1.500 / 1M $0.000 / 1M
कैश पढ़ने की कीमत $0.150 / 1M $0.000 / 1M
कैश लिखने की कीमत लागू नहीं $0.000 / 1M
कुल इनपुट टोकन 118,771 47,583
आउटपुट टोकन 4,127 0
रीजनिंग टोकन 14,668 0
प्रतिक्रिया समय (औसत) 91.72s 495ms
प्रतिक्रिया समय (अधिकतम) 112.76s 842ms
प्रतिक्रिया समय (कुल) 2109.54s 5.94s
पैरामीटर 218B कुल (25B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#377 Command A+

medium
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#390 GPT-6 Luna Decisions

default
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 93.13s 0 0 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

त्वरित तुलना

तुलना जोड़ी बदलें

Command A+mediumvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinylowCommand A+mediumvsLing 3.0 TinyhighCommand A+mediumvsNemotron 3.5 Lightningnoneनिःशुल्क उपलब्धCommand A+mediumvsGranite 4.1 8bdefaultCommand A+mediumvsLing 3.0 TinydefaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+mediumvsMercury 2.5noneCommand A+mediumvsJev 1.13default