नेविगेशन
Advertise here

GPT-6 Luna (high) vs Grok 4.5 (medium)

Grok 4.5 (medium) average score में आगे है: 7.8 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $2.454. GPT-6 Luna (high) तेज है: 20.37s vs 68.44s, pass rates 73.9% vs 79.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#111
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
रैंक
#104
कुल आउटपुट टोकन
306,044
प्रतिक्रिया समय (औसत)
68.44s
कुल लागत
$2.454
अनुशंसित मॉडल GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 33.2x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 7.7 7.8
रैंक #111 #104
विश्वसनीयता 10.0 10.0
संगति 8.7 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 79.7%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 0.492 14.430
कुल लागत $0.074 $2.454
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 229,986 308,369
आउटपुट टोकन 6,037 7,013
रीजनिंग टोकन 95,550 299,031
प्रतिक्रिया समय (औसत) 20.37s 68.44s
प्रतिक्रिया समय (अधिकतम) 106.93s 436.38s
प्रतिक्रिया समय (कुल) 468.52s 1574.14s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#104 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें