नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.5 की benchmark लागत कम है: $0.544 vs $0.727. GPT-5.5 तेज है: 2.35s vs 58.80s, pass rates 59.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#118
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
रैंक
#117
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.727
अनुशंसित मॉडल GPT-5.5

It has the best score here (7.0), while responding about 25.0x faster than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #118 #117
विश्वसनीयता 10.0 8.1
संगति 9.2 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 59.1% 65.2%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 4.533 6.923
कुल लागत $0.544 $0.727
इनपुट कीमत $5.000 / 1M $0.966 / 1M
आउटपुट कीमत $30.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 79,294 82,592
आउटपुट टोकन 4,915 16,089
रीजनिंग टोकन 0 199,800
प्रतिक्रिया समय (औसत) 2.35s 58.80s
प्रतिक्रिया समय (अधिकतम) 12.24s 308.75s
प्रतिक्रिया समय (कुल) 51.78s 1234.72s
पैरामीटर ~1.5T कुल (~100B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

#117 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें