नेविगेशन
Advertise here

GPT-5.6 Luna (high) vs GLM 5 (medium)

GLM 5 (medium) average score में आगे है: 7.7 vs 7.6. GPT-5.6 Luna (high) की benchmark लागत कम है: $0.179 vs $0.228. GPT-5.6 Luna (high) तेज है: 16.49s vs 33.54s, pass rates 69.7% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#94
कुल आउटपुट टोकन
135,315
प्रतिक्रिया समय (औसत)
16.49s
कुल लागत
$0.179
रैंक
#88
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.228
अनुशंसित मॉडल GPT-5.6 Luna (high)

Its score stays close to the best score here (7.6 vs 7.7), while responding about 2.0x faster than GLM 5 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna high रिलीज़: 2026-07-09 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.6 7.7
रैंक #94 #88
विश्वसनीयता 10.0 10.0
संगति 8.5 8.1
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 78.8%
अस्थिर टेस्ट 4 4
कुल रन 66 63
प्रति परिणाम लागत 6.100 1.668
कुल लागत $0.179 $0.228
इनपुट कीमत $0.200 / 1M $0.600 / 1M
आउटपुट कीमत $1.200 / 1M $1.920 / 1M
कुल इनपुट टोकन 80,927 35,224
आउटपुट टोकन 5,088 21,570
रीजनिंग टोकन 130,227 102,996
प्रतिक्रिया समय (औसत) 16.49s 33.54s
प्रतिक्रिया समय (अधिकतम) 111.09s 99.85s
प्रतिक्रिया समय (कुल) 362.78s 435.99s
पैरामीटर ~400B कुल (~17B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 GPT-5.6 Luna

high
लागत
$0.033
समय
34.2s
टोकन
5,484 tok

#88 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें