नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 vs GLM 5.3 Flash (high)

average score लगभग बराबर है: 7.3 vs 7.3. GLM 5.3 Flash (high) की benchmark लागत कम है: $0.029 vs $1.166. Claude Opus 4.8 तेज है: 4.92s vs 25.36s, pass rates 63.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-26

रैंक
#106
कुल आउटपुट टोकन
16,797
प्रतिक्रिया समय (औसत)
4.92s
कुल लागत
$1.166
रैंक
#102
कुल आउटपुट टोकन
78,318
प्रतिक्रिया समय (औसत)
25.36s
कुल लागत
$0.029
अनुशंसित मॉडल GLM 5.3 Flash (high)

It has the best score here (7.3), while costing about 41.6x less than Claude Opus 4.8.

विस्तृत तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 none रिलीज़: 2026-05-28 GLM 5.3 Flash GLM 5.3 Flash high रिलीज़: 2026-08-26
स्कोर 7.3 7.3
रैंक #106 #102
विश्वसनीयता 10.0 10.0
संगति 9.2 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 66.7%
अस्थिर टेस्ट 2 3
कुल रन 66 66
प्रति परिणाम लागत 8.969 0.216
कुल लागत $1.166 $0.029
इनपुट कीमत $5.000 / 1M $0.075 / 1M
आउटपुट कीमत $25.000 / 1M $0.250 / 1M
कुल इनपुट टोकन 149,203 113,003
आउटपुट टोकन 16,797 11,558
रीजनिंग टोकन 0 66,760
प्रतिक्रिया समय (औसत) 4.92s 25.36s
प्रतिक्रिया समय (अधिकतम) 35.03s 163.41s
प्रतिक्रिया समय (कुल) 108.24s 558.01s
पैरामीटर ~5T कुल (~500B सक्रिय) 320B कुल (18B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Claude Opus 4.8

none
लागत
$0.053
समय
22.0s
टोकन
2,253 tok

#102 GLM 5.3 Flash

high
लागत
$0.003
समय
186.7s
टोकन
10,486 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

त्वरित तुलना

तुलना जोड़ी बदलें