नेविगेशन
Advertise here

GPT-5.5 vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.5 की benchmark लागत कम है: $0.544 vs $0.726. GPT-5.5 तेज है: 2.35s vs 58.80s, pass rates 59.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#173
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
रैंक
#172
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.726
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while responding about 25.0x faster than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #173 #172
विश्वसनीयता 10.0 8.1
संगति 9.2 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 65.2%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 4.533 6.923
कुल लागत $0.544 $0.726
इनपुट कीमत $5.000 / 1M $0.965 / 1M
आउटपुट कीमत $30.000 / 1M $3.032 / 1M
कुल इनपुट टोकन 79,294 82,592
आउटपुट टोकन 4,915 16,089
रीजनिंग टोकन 0 199,800
प्रतिक्रिया समय (औसत) 2.35s 58.80s
प्रतिक्रिया समय (अधिकतम) 12.24s 308.75s
प्रतिक्रिया समय (कुल) 51.78s 1234.72s
पैरामीटर ~1.5T कुल (~100B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#173 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#172 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें