नेविगेशन
AI BENCHY
Advertise here

Claude Opus 4.6 (medium) vs GLM 5 (medium)

average score लगभग बराबर है: 7.7 vs 7.7. GLM 5 (medium) की benchmark लागत कम है: $0.228 vs $2.961. Claude Opus 4.6 (medium) तेज है: 32.23s vs 33.54s, pass rates 63.6% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#74
कुल आउटपुट टोकन
96,722
प्रतिक्रिया समय (औसत)
32.23s
कुल लागत
$2.961
रैंक
#72
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.228
अनुशंसित मॉडल GLM 5 (medium)

It has the best score here (7.7), while costing about 13.0x less than Claude Opus 4.6 (medium).

विस्तृत तुलना

मेट्रिक Claude Opus 4.6 Claude Opus 4.6 medium रिलीज़: 2026-02-05 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.7 7.7
रैंक #74 #72
विश्वसनीयता 10.0 10.0
संगति 8.8 8.1
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 78.8%
अस्थिर टेस्ट 3 4
कुल रन 66 63
प्रति परिणाम लागत 22.777 1.668
कुल लागत $2.961 $0.228
इनपुट कीमत $5.000 / 1M $0.600 / 1M
आउटपुट कीमत $25.000 / 1M $1.920 / 1M
कुल इनपुट टोकन 108,573 35,224
आउटपुट टोकन 69,994 21,570
रीजनिंग टोकन 26,728 102,996
प्रतिक्रिया समय (औसत) 32.23s 33.54s
प्रतिक्रिया समय (अधिकतम) 151.51s 99.85s
प्रतिक्रिया समय (कुल) 515.65s 435.99s
पैरामीटर ~5T कुल (~500B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.6

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#72 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें