नेविगेशन
AI BENCHY
Advertise here

GPT-5.5 (low) vs GLM 5.2 (medium)

GPT-5.5 (low) average score में आगे है: 9.3 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.224 vs $1.257. GPT-5.5 (low) तेज है: 10.15s vs 23.28s, pass rates 86.4% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#10
कुल आउटपुट टोकन
28,540
प्रतिक्रिया समय (औसत)
10.15s
कुल लागत
$1.257
रैंक
#65
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.224
अनुशंसित मॉडल GPT-5.5 (low)

It has the best score here (9.3), while responding about 2.3x faster than GLM 5.2 (medium).

विस्तृत तुलना

मेट्रिक GPT-5.5 GPT-5.5 low रिलीज़: 2026-04-24 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 9.3 7.8
रैंक #10 #65
विश्वसनीयता 10.0 9.5
संगति 10.0 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 86.4% 80.3%
अस्थिर टेस्ट 0 4
कुल रन 66 63
प्रति परिणाम लागत 6.614 2.159
कुल लागत $1.257 $0.224
इनपुट कीमत $5.000 / 1M $0.966 / 1M
आउटपुट कीमत $30.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 80,067 37,199
आउटपुट टोकन 5,378 12,261
रीजनिंग टोकन 23,162 49,500
प्रतिक्रिया समय (औसत) 10.15s 23.28s
प्रतिक्रिया समय (अधिकतम) 56.19s 101.36s
प्रतिक्रिया समय (कुल) 223.24s 488.94s
पैरामीटर ~1.5T कुल (~100B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#10 GPT-5.5

low
लागत
$0.068
समय
37.0s
टोकन
2,339 tok

#65 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

GPT-5.5lowvsGrok 4.6highQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumGemini 3.7 FlashmediumvsGPT-5.5lowGemini 3.5 FlashhighvsGPT-5.5lowKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumGemini 3.1 Pro PreviewmediumvsGPT-5.5lowQwen3.7 FlashhighvsGLM 5.2mediumGPT-5.6 TerrahighvsGLM 5.2mediumClaude Opus 5highvsGPT-5.5lowSeed-2.0-CodelowvsGLM 5.2medium