নেভিগেশন
AI BENCHY
Advertise here

Grok 4.20 (medium) vs GLM 5.1 (medium)

average score প্রায় সমান: 7.0 vs 7.0. GLM 5.1 (medium)-এর benchmark খরচ কম: $0.727 vs $0.805. Grok 4.20 (medium) দ্রুত: 32.56s vs 58.80s, pass rates 60.6% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#120
মোট আউটপুট টোকেন
270,259
প্রতিক্রিয়া সময় (গড়)
32.56s
মোট খরচ
$0.805
র‍্যাঙ্ক
#117
মোট আউটপুট টোকেন
215,889
প্রতিক্রিয়া সময় (গড়)
58.80s
মোট খরচ
$0.727
প্রস্তাবিত মডেল Grok 4.20 (medium)

It has the best score here (7.0), while responding about 1.8x faster than GLM 5.1 (medium).

বিস্তারিত তুলনা

মেট্রিক Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31 GLM 5.1 GLM 5.1 medium প্রকাশ: 2026-04-07
স্কোর 7.0 7.0
র‍্যাঙ্ক #120 #117
নির্ভরযোগ্যতা 10.0 8.1
ধারাবাহিকতা 8.2 8.4
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.6% 65.2%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 10.365 6.923
মোট খরচ $0.805 $0.727
ইনপুট মূল্য $1.250 / 1M $0.966 / 1M
আউটপুট মূল্য $2.500 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 102,986 82,592
আউটপুট টোকেন 5,860 16,089
রিজনিং টোকেন 264,399 199,800
প্রতিক্রিয়া সময় (গড়) 32.56s 58.80s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 199.66s 308.75s
প্রতিক্রিয়া সময় (মোট) 716.36s 1234.72s
প্যারামিটার ~1T মোট (~100B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 SpaceXAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

#117 GLM 5.1

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

দ্রুত তুলনা

তুলনার জুটি বদলান