नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Command A+ (low) vs GPT-6 Luna Decisions (default)

Command A+ (low) average score में आगे है: 3.0 vs 2.4. GPT-6 Luna Decisions (default) की benchmark लागत कम है: $0.005 vs $0.073. GPT-6 Luna Decisions (default) तेज है: 495ms vs 92.50s, pass rates 1.5% vs 13.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#386
कुल आउटपुट टोकन
25,521
प्रतिक्रिया समय (औसत)
92.50s
कुल लागत
$0.073
रैंक
#390
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
495ms
कुल लागत
$0.005
अनुशंसित मॉडल GPT-6 Luna Decisions (default)

Its score stays close to the best score here (2.4 vs 3.0), while costing about 15.3x less than Command A+ (low).

विस्तृत तुलना

मेट्रिक Command A+ Command A+ low रिलीज़: 2026-09-23 GPT-6 Luna Decisions GPT-6 Luna Decisions default रिलीज़: 2026-10-07
स्कोर 3.0 2.4
रैंक #386 #390
विश्वसनीयता 3.5 10.0
संगति 9.6 5.2
प्रयास 69/69 36/69
सही परीक्षण
प्रति प्रयास पास दर 1.5% 13.0%
अस्थिर टेस्ट 1 0
कुल रन 69 36
प्रति परिणाम लागत 0.000 0.159
कुल लागत $0.073 $0.005
इनपुट कीमत $0.300 / 1M $0.100 / 1M
आउटपुट कीमत $1.500 / 1M $0.000 / 1M
कैश पढ़ने की कीमत $0.150 / 1M $0.000 / 1M
कैश लिखने की कीमत लागू नहीं $0.000 / 1M
कुल इनपुट टोकन 114,874 47,583
आउटपुट टोकन 1,992 0
रीजनिंग टोकन 23,529 0
प्रतिक्रिया समय (औसत) 92.50s 495ms
प्रतिक्रिया समय (अधिकतम) 128.54s 842ms
प्रतिक्रिया समय (कुल) 2127.40s 5.94s
पैरामीटर 218B कुल (25B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#386 Command A+

low
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#390 GPT-6 Luna Decisions

default
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Command A+ 3.0 10.0 0.0% 0 86.43s 0 0 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

त्वरित तुलना

तुलना जोड़ी बदलें

Command A+lowvsJev 1.13defaultCommand A+lowvsGrok 4.20noneCommand A+lowvsKev 4BdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+lowvsLing 3.0 TinymediumCommand A+lowvsLing 3.0 TinyhighCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+lowvsNemotron 3.5 Lightningnoneनिःशुल्क उपलब्धCommand A+lowvsGranite 4.1 8bdefaultCommand A+lowvsLing 3.0 TinydefaultCommand A+mediumvsGPT-6 Luna Decisionsdefault