नेविगेशन
Advertise here

GPT-6 Luna (medium) vs Grok 4.5 (high)

average score लगभग बराबर है: 8.3 vs 8.2. GPT-6 Luna (medium) की benchmark लागत कम है: $0.047 vs $2.571. GPT-6 Luna (medium) तेज है: 18.07s vs 72.50s, pass rates 73.9% vs 82.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#79
कुल आउटपुट टोकन
53,161
प्रतिक्रिया समय (औसत)
18.07s
कुल लागत
$0.047
रैंक
#82
कुल आउटपुट टोकन
333,632
प्रतिक्रिया समय (औसत)
72.50s
कुल लागत
$2.571
अनुशंसित मॉडल GPT-6 Luna (medium)

It has the best score here (8.3), while costing about 54.8x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna medium रिलीज़: 2026-09-23 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 8.3 8.2
रैंक #79 #82
विश्वसनीयता 10.0 10.0
संगति 8.9 8.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 82.6%
अस्थिर टेस्ट 3 3
कुल रन 69 69
प्रति परिणाम लागत 0.313 15.123
कुल लागत $0.047 $2.571
इनपुट कीमत $0.100 / 1M $2.000 / 1M
आउटपुट कीमत $0.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 203,193 342,124
आउटपुट टोकन 5,751 7,135
रीजनिंग टोकन 47,410 326,497
प्रतिक्रिया समय (औसत) 18.07s 72.50s
प्रतिक्रिया समय (अधिकतम) 66.44s 676.83s
प्रतिक्रिया समय (कुल) 415.53s 1667.51s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 GPT-6 Luna

medium
लागत
$0.002
समय
23.6s
टोकन
2,966 tok

#82 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें