नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs Grok 4.20 (medium)

GPT-5.6 Luna (medium) average score में आगे है: 7.4 vs 6.3. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.065 vs $1.246. GPT-5.6 Luna (medium) तेज है: 9.64s vs 36.73s, pass rates 62.3% vs 58.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.065
रैंक
#224
कुल आउटपुट टोकन
302,087
प्रतिक्रिया समय (औसत)
36.73s
कुल लागत
$1.246
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 19.3x less than Grok 4.20 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.4 6.3
रैंक #122 #224
विश्वसनीयता 10.0 10.0
संगति 9.0 8.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 58.0%
अस्थिर टेस्ट 3 5
कुल रन 69 69
प्रति परिणाम लागत 2.822 14.374
कुल लागत $0.065 $1.246
इनपुट कीमत $0.200 / 1M $1.250 / 1M
आउटपुट कीमत $1.200 / 1M $2.500 / 1M
कैश पढ़ने की कीमत $0.020 / 1M $0.200 / 1M
कैश लिखने की कीमत $0.250 / 1M लागू नहीं
कुल इनपुट टोकन 212,780 392,127
आउटपुट टोकन 6,849 7,754
रीजनिंग टोकन 41,137 294,333
प्रतिक्रिया समय (औसत) 9.64s 36.73s
प्रतिक्रिया समय (अधिकतम) 58.09s 199.66s
प्रतिक्रिया समय (कुल) 221.62s 844.68s
पैरामीटर ~400B कुल (~17B सक्रिय) ~1T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#224 SpaceXAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

त्वरित तुलना

तुलना जोड़ी बदलें