नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs Z.ai: GLM 5

GLM 5 (medium) average score मध्ये पुढे आहे: 7.7 vs 7.5. GLM 5 (medium) चा benchmark खर्च कमी आहे: $0.307 vs $1.550. Claude Opus 5 वेगवान आहे: 7.60s vs 33.54s, pass rates 57.6% vs 78.8%.

शिफारस केलेले मॉडेलGLM 5 (medium)It has the best score here (7.7), while costing about 5.0x less than Claude Opus 5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none प्रकाशन: 2026-07-25 GLM 5 GLM 5 medium प्रकाशन: 2026-02-12
स्कोअर 7.5 7.7
क्रमांक #59 #49
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.1
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 78.8%
अस्थिर चाचण्या 1 4
एकूण रन 66 63
प्रति निकाल खर्च 12.912 1.668
एकूण खर्च $1.550 $0.307
इनपुट किंमत $5.000 / 1M $0.950 / 1M
आउटपुट किंमत $25.000 / 1M $2.551 / 1M
एकूण इनपुट टोकन्स 185,550 35,224
आउटपुट टोकन्स 24,866 21,570
रिझनिंग टोकन्स 0 102,996
प्रतिसाद वेळ (सरासरी) 7.60s 33.54s
प्रतिसाद वेळ (कमाल) 47.72s 99.85s
प्रतिसाद वेळ (एकूण) 167.28s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
खर्च
$0.271
वेळ
149.3s
टोकन्स
10,962 tok

#49 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

झटपट तुलना

तुलना जोडी बदला