नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.7 (high)

Grok 4.7 (high) average score में आगे है: 7.5 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.072 vs $2.180. GPT-5.6 Luna (medium) तेज है: 7.43s vs 113.10s, pass rates 62.1% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-22

तुलना किए गए मॉडल

रैंक
#123
कुल आउटपुट टोकन
44,525
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.072
रैंक
#111
कुल आउटपुट टोकन
416,086
प्रतिक्रिया समय (औसत)
113.10s
कुल लागत
$2.180
अनुशंसित मॉडल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.4 vs 7.5), while costing about 30.5x less than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 7.4 7.5
रैंक #123 #111
विश्वसनीयता 10.0 9.5
संगति 9.2 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 75.8%
अस्थिर टेस्ट 2 7
कुल रन 66 66
प्रति परिणाम लागत 2.601 16.765
कुल लागत $0.072 $2.180
इनपुट कीमत $0.200 / 1M $1.600 / 1M
आउटपुट कीमत $1.200 / 1M $4.800 / 1M
कुल इनपुट टोकन 89,685 113,892
आउटपुट टोकन 5,701 6,907
रीजनिंग टोकन 38,824 409,179
प्रतिक्रिया समय (औसत) 7.43s 113.10s
प्रतिक्रिया समय (अधिकतम) 29.85s 573.57s
प्रतिक्रिया समय (कुल) 163.54s 2488.20s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#111 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें