नेविगेशन
Advertise here

GPT-6 Luna (high) vs Grok 4.5 (low)

Grok 4.5 (low) average score में आगे है: 7.8 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $1.345. Grok 4.5 (low) तेज है: 18.14s vs 20.37s, pass rates 73.9% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#111
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
रैंक
#109
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
अनुशंसित मॉडल GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 18.2x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 7.7 7.8
रैंक #111 #109
विश्वसनीयता 10.0 10.0
संगति 8.7 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 73.9%
अस्थिर टेस्ट 4 2
कुल रन 69 69
प्रति परिणाम लागत 0.492 8.404
कुल लागत $0.074 $1.345
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 229,986 308,068
आउटपुट टोकन 6,037 9,218
रीजनिंग टोकन 95,550 112,197
प्रतिक्रिया समय (औसत) 20.37s 18.14s
प्रतिक्रिया समय (अधिकतम) 106.93s 205.28s
प्रतिक्रिया समय (कुल) 468.52s 417.21s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

#109 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें