नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 (low) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score में आगे है: 7.8 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.276 vs $2.089. Claude Opus 4.8 (low) तेज है: 12.88s vs 23.28s, pass rates 80.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#71
कुल आउटपुट टोकन
52,237
प्रतिक्रिया समय (औसत)
12.88s
कुल लागत
$2.089
रैंक
#66
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.276
अनुशंसित मॉडल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 7.6x less than Claude Opus 4.8 (low).

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 low रिलीज़: 2026-05-28 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.8 7.8
रैंक #71 #66
विश्वसनीयता 10.0 9.5
संगति 8.9 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 80.3% 80.3%
अस्थिर टेस्ट 3 4
कुल रन 66 63
प्रति परिणाम लागत 13.054 2.159
कुल लागत $2.089 $0.276
इनपुट कीमत $5.000 / 1M $1.190 / 1M
आउटपुट कीमत $25.000 / 1M $3.740 / 1M
कुल इनपुट टोकन 156,522 37,199
आउटपुट टोकन 43,056 12,261
रीजनिंग टोकन 9,181 49,500
प्रतिक्रिया समय (औसत) 12.88s 23.28s
प्रतिक्रिया समय (अधिकतम) 127.97s 101.36s
प्रतिक्रिया समय (कुल) 283.32s 488.94s
पैरामीटर ~5T कुल (~500B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Opus 4.8

low
लागत
$0.031
समय
14.1s
टोकन
1,345 tok

#66 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 6.6 4.6 77.8% 2 7.58s 10,590 3,637 809
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Opus 4.8lowvsSeed-2.0-LitemediumClaude Opus 4.8lowvsQwen3.7 FlashhighClaude Opus 4.8lowvsQwen3.8 27BmediumClaude Opus 4.8lowvsGLM 5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumClaude Opus 4.8lowvsGPT-5.6 TerramediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGemini 3.5 Flash LitemediumClaude Opus 4.8lowvsQwen3.6 PlusmediumQwen3.7 FlashhighvsGLM 5.2mediumClaude Opus 4.8lowvsDeepSeek V4 Prohigh