नेव्हिगेशन
AI BENCHY
Advertise here

Claude Opus 4.8 (medium) vs GLM 5.2 (medium)

Claude Opus 4.8 (medium) average score मध्ये पुढे आहे: 8.8 vs 7.8. GLM 5.2 (medium) चा benchmark खर्च कमी आहे: $0.178 vs $1.931. Claude Opus 4.8 (medium) वेगवान आहे: 12.49s vs 23.28s, pass rates 84.9% vs 80.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-05

क्रमांक
#19
एकूण आउटपुट टोकन्स
49,841
प्रतिसाद वेळ (सरासरी)
12.49s
एकूण खर्च
$1.931
क्रमांक
#54
एकूण आउटपुट टोकन्स
61,761
प्रतिसाद वेळ (सरासरी)
23.28s
एकूण खर्च
$0.178
शिफारस केलेले मॉडेल Claude Opus 4.8 (medium)

It has the best score here (8.8), while responding about 1.9x faster than GLM 5.2 (medium).

तपशीलवार तुलना

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 medium प्रकाशन: 2026-05-28 GLM 5.2 GLM 5.2 medium प्रकाशन: 2026-06-17
स्कोअर 8.8 7.8
क्रमांक #19 #54
विश्वसनीयता 10.0 9.5
सुसंगतता 9.6 8.0
बेंचमार्क कव्हरेज 22/22 चाचण्या · 66/66 प्रयत्न 21/22 चाचण्या · 63/66 प्रयत्न
बरोबर चाचण्या
प्रति प्रयत्न पास दर 84.9% 80.3%
अस्थिर चाचण्या 1 4
एकूण रन 66 63
प्रति निकाल खर्च 10.724 2.159
एकूण खर्च $1.931 $0.178
इनपुट किंमत $5.000 / 1M $0.760 / 1M
आउटपुट किंमत $25.000 / 1M $2.420 / 1M
एकूण इनपुट टोकन्स 138,451 37,199
आउटपुट टोकन्स 40,766 12,261
रिझनिंग टोकन्स 9,075 49,500
प्रतिसाद वेळ (सरासरी) 12.49s 23.28s
प्रतिसाद वेळ (कमाल) 70.54s 101.36s
प्रतिसाद वेळ (एकूण) 274.72s 488.94s

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Claude Opus 4.8

medium
खर्च
$0.057
वेळ
23.1s
टोकन्स
2,412 tok

#54 GLM 5.2

medium
खर्च
$0.041
वेळ
195.8s
टोकन्स
9,287 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 15.33s 10,590 9,945 1,381
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

झटपट तुलना

तुलना जोडी बदला

Qwen3.7 FlashhighvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumClaude Opus 4.8mediumvsGrok 4.5highClaude Opus 4.8mediumvsMuse Spark 1.2highClaude Opus 4.8mediumvsGemini 3.5 FlashlowClaude Opus 4.8mediumvsGemini 3.5 Flash LitehighGPT-5.6 TerrahighvsGLM 5.2mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8mediumvsGemini 3.6 FlashlowGPT-5.6 LunahighvsGLM 5.2mediumClaude Opus 4.8mediumvsQwen3.8 MaxlowDeepSeek V4 FlashhighvsGLM 5.2medium