नेविगेशन
Advertise here

GPT-6 Luna (high) vs Grok 4.6 (medium)

Grok 4.6 (medium) average score में आगे है: 7.8 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $2.270. GPT-6 Luna (high) तेज है: 20.37s vs 74.77s, pass rates 73.9% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#111
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
रैंक
#107
कुल आउटपुट टोकन
266,197
प्रतिक्रिया समय (औसत)
74.77s
कुल लागत
$2.270
अनुशंसित मॉडल GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 30.8x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12
स्कोर 7.7 7.8
रैंक #111 #107
विश्वसनीयता 10.0 10.0
संगति 8.7 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 78.3%
अस्थिर टेस्ट 4 4
कुल रन 69 69
प्रति परिणाम लागत 0.492 14.187
कुल लागत $0.074 $2.270
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 229,986 336,351
आउटपुट टोकन 6,037 6,180
रीजनिंग टोकन 95,550 260,017
प्रतिक्रिया समय (औसत) 20.37s 74.77s
प्रतिक्रिया समय (अधिकतम) 106.93s 514.35s
प्रतिक्रिया समय (कुल) 468.52s 1719.73s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#107 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

त्वरित तुलना

तुलना जोड़ी बदलें