নেভিগেশন
Advertise here

Grok 4.7 (high) vs GLM 5.2

average score প্রায় সমান: 6.7 vs 6.6. GLM 5.2-এর benchmark খরচ কম: $0.152 vs $3.582. GLM 5.2 দ্রুত: 11.27s vs 122.19s, pass rates 72.5% vs 63.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#179
মোট আউটপুট টোকেন
487,184
প্রতিক্রিয়া সময় (গড়)
122.19s
মোট খরচ
$3.582
র‍্যাঙ্ক
#186
মোট আউটপুট টোকেন
17,685
প্রতিক্রিয়া সময় (গড়)
11.27s
মোট খরচ
$0.152
প্রস্তাবিত মডেল GLM 5.2

It has the best score here (6.6), while costing about 23.7x less than Grok 4.7 (high).

বিস্তারিত তুলনা

মেট্রিক Grok 4.7 Grok 4.7 high প্রকাশ: 2026-09-21 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 6.7 6.6
র‍্যাঙ্ক #179 #186
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 7.7 9.0
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.5% 63.8%
অস্থির টেস্ট 7 3
মোট রান 69 69
প্রতি ফলাফলে খরচ 23.360 1.753
মোট খরচ $3.582 $0.152
ইনপুট মূল্য $2.000 / 1M $0.325 / 1M
আউটপুট মূল্য $6.000 / 1M $3.990 / 1M
মোট ইনপুট টোকেন 329,276 247,919
আউটপুট টোকেন 8,172 17,685
রিজনিং টোকেন 479,012 0
প্রতিক্রিয়া সময় (গড়) 122.19s 11.27s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 573.57s 79.65s
প্রতিক্রিয়া সময় (মোট) 2810.40s 259.32s
প্যারামিটার ~1.7T মোট (~170B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 SpaceXAI: Grok 4.7

high
খরচ
$0.110
সময়
301.3s
টোকেন
23,143 tok

#186 GLM 5.2

none
খরচ
$0.033
সময়
87.7s
টোকেন
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

দ্রুত তুলনা

তুলনার জুটি বদলান