নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GLM 5.2 (medium) vs GLM 5 (medium)

GLM 5.2 (medium) average score-এ এগিয়ে: 7.8 vs 7.7. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.176 vs $0.307. GLM 5.2 (medium) দ্রুত: 23.28s vs 33.54s, pass rates 80.3% vs 78.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#49
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.176
র‍্যাঙ্ক
#54
মোট আউটপুট টোকেন
124,566
প্রতিক্রিয়া সময় (গড়)
33.54s
মোট খরচ
$0.307
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (7.8), while costing about 1.7x less than GLM 5 (medium).

বিস্তারিত তুলনা

মেট্রিক GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17 GLM 5 GLM 5 medium প্রকাশ: 2026-02-12
স্কোর 7.8 7.7
র‍্যাঙ্ক #49 #54
নির্ভরযোগ্যতা 9.5 10.0
ধারাবাহিকতা 8.0 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 80.3% 78.8%
অস্থির টেস্ট 4 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 2.159 1.668
মোট খরচ $0.176 $0.307
ইনপুট মূল্য $0.761 / 1M $0.950 / 1M
আউটপুট মূল্য $2.389 / 1M $2.551 / 1M
মোট ইনপুট টোকেন 37,199 35,224
আউটপুট টোকেন 12,261 21,570
রিজনিং টোকেন 49,500 102,996
প্রতিক্রিয়া সময় (গড়) 23.28s 33.54s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 101.36s 99.85s
প্রতিক্রিয়া সময় (মোট) 488.94s 435.99s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

#54 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

দ্রুত তুলনা

তুলনার জুটি বদলান