नेविगेशन
Advertise here

GPT-6 Luna Decisions (default) vs Grok 4.20

Grok 4.20 average score में आगे है: 3.4 vs 2.4. GPT-6 Luna Decisions (default) की benchmark लागत कम है: $0.005 vs $0.057. GPT-6 Luna Decisions (default) तेज है: 495ms vs 1.11s, pass rates 13.0% vs 26.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#390
कुल आउटपुट टोकन
0
प्रतिक्रिया समय (औसत)
495ms
कुल लागत
$0.005
रैंक
#376
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

It has the strongest score in this comparison (3.4) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक GPT-6 Luna Decisions GPT-6 Luna Decisions default रिलीज़: 2026-10-07 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 2.4 3.4
रैंक #390 #376
विश्वसनीयता 10.0 लागू नहीं
संगति 5.2 7.8
प्रयास 36/69 54/69
सही परीक्षण
प्रति प्रयास पास दर 13.0% 26.1%
अस्थिर टेस्ट 0 0
कुल रन 36 54
प्रति परिणाम लागत 0.159 1.570
कुल लागत $0.005 $0.057
इनपुट कीमत $0.100 / 1M $1.250 / 1M
आउटपुट कीमत $0.000 / 1M $2.500 / 1M
कैश पढ़ने की कीमत $0.000 / 1M $0.200 / 1M
कैश लिखने की कीमत $0.000 / 1M लागू नहीं
कुल इनपुट टोकन 47,583 41,313
आउटपुट टोकन 0 1,923
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 495ms 1.11s
प्रतिक्रिया समय (अधिकतम) 842ms 6.04s
प्रतिक्रिया समय (कुल) 5.94s 19.96s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#390 GPT-6 Luna Decisions

default
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

#376 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultQwen3.5-9BmediumvsGrok 4.20none