নেভিগেশন
AI BENCHY
Advertise here

Grok 4.5 (medium) vs GLM 5.2 (medium)

Grok 4.5 (medium) average score-এ এগিয়ে: 8.5 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.224 vs $2.042. GLM 5.2 (medium) দ্রুত: 23.28s vs 68.59s, pass rates 83.3% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#37
মোট আউটপুট টোকেন
299,460
প্রতিক্রিয়া সময় (গড়)
68.59s
মোট খরচ
$2.042
র‍্যাঙ্ক
#65
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.224
প্রস্তাবিত মডেল GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 8.5), while costing about 9.1x less than Grok 4.5 (medium).

বিস্তারিত তুলনা

মেট্রিক Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 8.5 7.8
র‍্যাঙ্ক #37 #65
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 8.9 8.0
প্রচেষ্টা 66/66 63/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 80.3%
অস্থির টেস্ট 3 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 12.007 2.159
মোট খরচ $2.042 $0.224
ইনপুট মূল্য $2.000 / 1M $0.966 / 1M
আউটপুট মূল্য $6.000 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 122,155 37,199
আউটপুট টোকেন 5,514 12,261
রিজনিং টোকেন 293,946 49,500
প্রতিক্রিয়া সময় (গড়) 68.59s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 436.38s 101.36s
প্রতিক্রিয়া সময় (মোট) 1508.91s 488.94s
প্যারামিটার ~1.7T মোট (~170B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 SpaceXAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

#65 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান

Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium