नेविगेशन
Advertise here

GPT-5.6 Luna (medium) vs GLM 5.3 Flash (high)

GPT-5.6 Luna (medium) average score में आगे है: 7.4 vs 7.3. GLM 5.3 Flash (high) की benchmark लागत कम है: $0.084 vs $0.101. GPT-5.6 Luna (medium) तेज है: 9.64s vs 29.11s, pass rates 62.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#122
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.101
रैंक
#132
कुल आउटपुट टोकन
99,340
प्रतिक्रिया समय (औसत)
29.11s
कुल लागत
$0.084
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while responding about 3.0x faster than GLM 5.3 Flash (high).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 GLM 5.3 Flash GLM 5.3 Flash high रिलीज़: 2026-08-26
स्कोर 7.4 7.3
रैंक #122 #132
विश्वसनीयता 10.0 10.0
संगति 9.0 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 66.7%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 2.822 0.426
कुल लागत $0.101 $0.084
इनपुट कीमत $0.200 / 1M $0.150 / 1M
आउटपुट कीमत $1.200 / 1M $0.500 / 1M
कुल इनपुट टोकन 212,780 225,013
आउटपुट टोकन 6,849 12,197
रीजनिंग टोकन 41,137 87,143
प्रतिक्रिया समय (औसत) 9.64s 29.11s
प्रतिक्रिया समय (अधिकतम) 58.09s 163.41s
प्रतिक्रिया समय (कुल) 221.62s 669.54s
पैरामीटर ~400B कुल (~17B सक्रिय) 320B कुल (18B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#132 GLM 5.3 Flash

high
लागत
$0.003
समय
186.7s
टोकन
10,486 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

त्वरित तुलना

तुलना जोड़ी बदलें