নেভিগেশন
Advertise here

Grok 4.5 (high) vs GLM 5.2 (medium)

average score প্রায় সমান: 8.2 vs 8.2. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.398 vs $2.571. GLM 5.2 (medium) দ্রুত: 26.88s vs 72.50s, pass rates 82.6% vs 81.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#82
মোট আউটপুট টোকেন
333,632
প্রতিক্রিয়া সময় (গড়)
72.50s
মোট খরচ
$2.571
র‍্যাঙ্ক
#83
মোট আউটপুট টোকেন
81,020
প্রতিক্রিয়া সময় (গড়)
26.88s
মোট খরচ
$0.398
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (8.2), while costing about 6.5x less than Grok 4.5 (high).

বিস্তারিত তুলনা

মেট্রিক Grok 4.5 Grok 4.5 high প্রকাশ: 2026-07-08 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 8.2 8.2
র‍্যাঙ্ক #82 #83
নির্ভরযোগ্যতা 10.0 9.6
ধারাবাহিকতা 8.9 8.1
প্রচেষ্টা 69/69 66/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 82.6% 81.2%
অস্থির টেস্ট 3 4
মোট রান 69 66
প্রতি ফলাফলে খরচ 15.123 2.890
মোট খরচ $2.571 $0.398
ইনপুট মূল্য $2.000 / 1M $0.325 / 1M
আউটপুট মূল্য $6.000 / 1M $3.990 / 1M
মোট ইনপুট টোকেন 342,124 227,164
আউটপুট টোকেন 7,135 20,029
রিজনিং টোকেন 326,497 60,991
প্রতিক্রিয়া সময় (গড়) 72.50s 26.88s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 676.83s 102.40s
প্রতিক্রিয়া সময় (মোট) 1667.51s 591.34s
প্যারামিটার ~1.7T মোট (~170B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#82 SpaceXAI: Grok 4.5

high
খরচ
$0.015
সময়
29.7s
টোকেন
2,737 tok

#83 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান