নেভিগেশন
AI BENCHY
Advertise here

Grok 4.6 (low) vs GLM 5.3 (high)

average score প্রায় সমান: 7.4 vs 7.3. GLM 5.3 (high)-এর benchmark খরচ কম: $0.403 vs $0.449. Grok 4.6 (low) দ্রুত: 14.55s vs 27.82s, pass rates 69.7% vs 74.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-20

র‍্যাঙ্ক
#96
মোট আউটপুট টোকেন
38,048
প্রতিক্রিয়া সময় (গড়)
14.55s
মোট খরচ
$0.449
র‍্যাঙ্ক
#99
মোট আউটপুট টোকেন
63,667
প্রতিক্রিয়া সময় (গড়)
27.82s
মোট খরচ
$0.403
প্রস্তাবিত মডেল Grok 4.6 (low)

It has the best score here (7.4), while responding about 1.9x faster than GLM 5.3 (high).

বিস্তারিত তুলনা

মেট্রিক Grok 4.6 Grok 4.6 low প্রকাশ: 2026-08-12 GLM 5.3 GLM 5.3 high প্রকাশ: 2026-08-20
স্কোর 7.4 7.3
র‍্যাঙ্ক #96 #99
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 7.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 74.2%
অস্থির টেস্ট 1 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 2.989 3.099
মোট খরচ $0.449 $0.403
ইনপুট মূল্য $2.000 / 1M $1.400 / 1M
আউটপুট মূল্য $6.000 / 1M $4.400 / 1M
মোট ইনপুট টোকেন 109,960 87,601
আউটপুট টোকেন 5,124 6,006
রিজনিং টোকেন 32,924 57,661
প্রতিক্রিয়া সময় (গড়) 14.55s 27.82s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 26.46s 159.91s
প্রতিক্রিয়া সময় (মোট) 320.17s 612.06s
প্যারামিটার ~1.7T মোট (~170B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 SpaceXAI: Grok 4.6

low
খরচ
$0.011
সময়
26.0s
টোকেন
1,941 tok

#99 GLM 5.3

high
খরচ
$0.085
সময়
362.5s
টোকেন
19,310 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

দ্রুত তুলনা

তুলনার জুটি বদলান