नेविगेशन
AI BENCHY
Advertise here

GPT-5.6 Sol vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.6 Sol की benchmark लागत कम है: $0.524 vs $0.727. GPT-5.6 Sol तेज है: 2.17s vs 58.80s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#115
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.524
रैंक
#117
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.727
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while responding about 27.1x faster than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #115 #117
विश्वसनीयता 10.0 8.1
संगति 9.0 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 4.365 6.923
कुल लागत $0.524 $0.727
इनपुट कीमत $5.000 / 1M $0.966 / 1M
आउटपुट कीमत $30.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 78,602 82,592
आउटपुट टोकन 4,357 16,089
रीजनिंग टोकन 0 199,800
प्रतिक्रिया समय (औसत) 2.17s 58.80s
प्रतिक्रिया समय (अधिकतम) 12.81s 308.75s
प्रतिक्रिया समय (कुल) 47.66s 1234.72s
पैरामीटर ~2T कुल (~150B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

#117 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें