नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs GLM 5.1 (medium)

GLM 5.1 (medium) average score में आगे है: 7.5 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.065 vs $1.546. GPT-5.6 Luna (medium) तेज है: 9.64s vs 66.38s, pass rates 62.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-05

तुलना किए गए मॉडल

रैंक
#126
कुल आउटपुट टोकन
47,986
प्रतिक्रिया समय (औसत)
9.64s
कुल लागत
$0.065
रैंक
#123
कुल आउटपुट टोकन
248,708
प्रतिक्रिया समय (औसत)
66.38s
कुल लागत
$1.546
अनुशंसित मॉडल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.4 vs 7.5), while costing about 24.0x less than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.4 7.5
रैंक #126 #123
विश्वसनीयता 10.0 9.2
संगति 9.0 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 66.7%
अस्थिर टेस्ट 3 4
कुल रन 69 69
प्रति परिणाम लागत 2.822 9.004
कुल लागत $0.065 $1.546
इनपुट कीमत $0.200 / 1M $1.400 / 1M
आउटपुट कीमत $1.200 / 1M $4.400 / 1M
कैश पढ़ने की कीमत $0.020 / 1M $0.260 / 1M
कैश लिखने की कीमत $0.250 / 1M लागू नहीं
कुल इनपुट टोकन 212,780 331,577
आउटपुट टोकन 6,849 17,919
रीजनिंग टोकन 41,137 230,789
प्रतिक्रिया समय (औसत) 9.64s 66.38s
प्रतिक्रिया समय (अधिकतम) 58.09s 308.75s
प्रतिक्रिया समय (कुल) 221.62s 1460.31s
पैरामीटर ~400B कुल (~17B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

#123 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें