नेविगेशन
Advertise here

GPT-6 Luna (low) vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-6 Luna (low) की benchmark लागत कम है: $0.020 vs $0.727. GPT-6 Luna (low) तेज है: 21.96s vs 58.80s, pass rates 62.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-23

तुलना किए गए मॉडल

रैंक
#159
कुल आउटपुट टोकन
22,605
प्रतिक्रिया समय (औसत)
21.96s
कुल लागत
$0.020
रैंक
#161
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.727
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 37.6x less than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #159 #161
विश्वसनीयता 9.6 8.1
संगति 8.5 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 65.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 0.176 6.923
कुल लागत $0.020 $0.727
इनपुट कीमत $0.100 / 1M $0.966 / 1M
आउटपुट कीमत $0.500 / 1M $3.036 / 1M
कुल इनपुट टोकन 80,159 82,592
आउटपुट टोकन 4,623 16,089
रीजनिंग टोकन 17,982 199,800
प्रतिक्रिया समय (औसत) 21.96s 58.80s
प्रतिक्रिया समय (अधिकतम) 89.37s 308.75s
प्रतिक्रिया समय (कुल) 483.19s 1234.72s
पैरामीटर ~400B कुल (~17B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#159 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

#161 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें