নেভিগেশন
Advertise here

Grok 4.7 (low) vs GLM 5.2 (medium)

Grok 4.7 (low) average score-এ এগিয়ে: 7.9 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.151 vs $1.320. GLM 5.2 (medium) দ্রুত: 23.28s vs 59.02s, pass rates 77.3% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-22

তুলনা করা মডেল

র‍্যাঙ্ক
#82
মোট আউটপুট টোকেন
231,848
প্রতিক্রিয়া সময় (গড়)
59.02s
মোট খরচ
$1.320
র‍্যাঙ্ক
#90
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.151
প্রস্তাবিত মডেল GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 7.9), while costing about 8.8x less than Grok 4.7 (low).

বিস্তারিত তুলনা

মেট্রিক Grok 4.7 Grok 4.7 low প্রকাশ: 2026-09-21 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.9 7.8
র‍্যাঙ্ক #82 #90
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 8.3 8.0
প্রচেষ্টা 66/66 63/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 77.3% 80.3%
অস্থির টেস্ট 5 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 9.422 2.159
মোট খরচ $1.320 $0.151
ইনপুট মূল্য $1.600 / 1M $0.650 / 1M
আউটপুট মূল্য $4.800 / 1M $2.042 / 1M
মোট ইনপুট টোকেন 128,832 37,199
আউটপুট টোকেন 6,840 12,261
রিজনিং টোকেন 225,008 49,500
প্রতিক্রিয়া সময় (গড়) 59.02s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 389.63s 101.36s
প্রতিক্রিয়া সময় (মোট) 1298.42s 488.94s
প্যারামিটার ~1.7T মোট (~170B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#82 SpaceXAI: Grok 4.7

low
খরচ
$0.007
সময়
15.2s
টোকেন
1,537 tok

#90 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান