नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.6 Luna (medium) vs GLM 5.1 (medium)

GLM 5.1 (medium) average score मध्ये पुढे आहे: 7.5 vs 7.4. GPT-5.6 Luna (medium) चा benchmark खर्च कमी आहे: $0.065 vs $1.546. GPT-5.6 Luna (medium) वेगवान आहे: 9.64s vs 66.38s, pass rates 62.3% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-05

तुलना केलेली मॉडेल्स

क्रमांक
#126
एकूण आउटपुट टोकन्स
47,986
प्रतिसाद वेळ (सरासरी)
9.64s
एकूण खर्च
$0.065
क्रमांक
#123
एकूण आउटपुट टोकन्स
248,708
प्रतिसाद वेळ (सरासरी)
66.38s
एकूण खर्च
$1.546
शिफारस केलेले मॉडेल GPT-5.6 Luna (medium)

Its score stays close to the best score here (7.4 vs 7.5), while costing about 24.0x less than GLM 5.1 (medium).

तपशीलवार तुलना

मेट्रिक GPT-5.6 Luna GPT-5.6 Luna medium प्रकाशन: 2026-07-09 GLM 5.1 GLM 5.1 medium प्रकाशन: 2026-04-07
स्कोअर 7.4 7.5
क्रमांक #126 #123
विश्वसनीयता 10.0 9.2
सुसंगतता 9.0 8.4
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 62.3% 66.7%
अस्थिर चाचण्या 3 4
एकूण रन 69 69
प्रति निकाल खर्च 2.822 9.004
एकूण खर्च $0.065 $1.546
इनपुट किंमत $0.200 / 1M $1.400 / 1M
आउटपुट किंमत $1.200 / 1M $4.400 / 1M
कॅश वाचण्याची किंमत $0.020 / 1M $0.260 / 1M
कॅश लिहिण्याची किंमत $0.250 / 1M लागू नाही
एकूण इनपुट टोकन्स 212,780 331,577
आउटपुट टोकन्स 6,849 17,919
रिझनिंग टोकन्स 41,137 230,789
प्रतिसाद वेळ (सरासरी) 9.64s 66.38s
प्रतिसाद वेळ (कमाल) 58.09s 308.75s
प्रतिसाद वेळ (एकूण) 221.62s 1460.31s
पॅरामीटर्स ~400B एकूण (~17B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 GPT-5.6 Luna

medium
खर्च
$0.014
वेळ
14.6s
टोकन्स
2,362 tok

#123 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

झटपट तुलना

तुलना जोडी बदला