নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs Z.ai: GLM 5

GLM 5 (medium) average score-এ এগিয়ে: 7.7 vs 7.5. GLM 5 (medium)-এর benchmark খরচ কম: $0.307 vs $1.550. Claude Opus 5 দ্রুত: 7.60s vs 33.54s, pass rates 57.6% vs 78.8%.

প্রস্তাবিত মডেলGLM 5 (medium)It has the best score here (7.7), while costing about 5.0x less than Claude Opus 5.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 none প্রকাশ: 2026-07-25 GLM 5 GLM 5 medium প্রকাশ: 2026-02-12
স্কোর 7.5 7.7
র‍্যাঙ্ক #59 #49
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.6% 78.8%
অস্থির টেস্ট 1 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 12.912 1.668
মোট খরচ $1.550 $0.307
ইনপুট মূল্য $5.000 / 1M $0.950 / 1M
আউটপুট মূল্য $25.000 / 1M $2.551 / 1M
মোট ইনপুট টোকেন 185,550 35,224
আউটপুট টোকেন 24,866 21,570
রিজনিং টোকেন 0 102,996
প্রতিক্রিয়া সময় (গড়) 7.60s 33.54s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.72s 99.85s
প্রতিক্রিয়া সময় (মোট) 167.28s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
খরচ
$0.271
সময়
149.3s
টোকেন
10,962 tok

#49 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

দ্রুত তুলনা

তুলনার জুটি বদলান