নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 5.2

সারাংশ

Grok 4.20 vs GLM 5.2 benchmark তুলনা: Grok 4.20 average score-এ এগিয়ে: 7.3 vs 7.1. GLM 5.2-এর benchmark খরচ কম: $0.076 vs $0.609. GLM 5.2 দ্রুত: 6.34s vs 27.68s, pass rates 63.5% vs 60.3%.

প্রস্তাবিত মডেল: GLM 5.2 - Its score stays close to the best score here (7.1 vs 7.3), while costing about 8.1x less than Grok 4.20.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-17

মেট্রিক Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31 GLM 5.2 GLM 5.2 none প্রকাশ: 2026-06-17
স্কোর 7.3 7.1
র‍্যাঙ্ক #53 #61
নির্ভরযোগ্যতা 10.0 9.9
ধারাবাহিকতা 8.8 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.5% 60.3%
অস্থির টেস্ট 3 1
মোট রান 63 63
প্রতি ফলাফলে খরচ 8.309 0.628
মোট খরচ $0.609 $0.076
ইনপুট মূল্য $1.250 / 1M $1.400 / 1M
আউটপুট মূল্য $2.500 / 1M $4.400 / 1M
মোট ইনপুট টোকেন 44,433 38,671
আউটপুট টোকেন 1,819 4,817
রিজনিং টোকেন 219,524 0
প্রতিক্রিয়া সময় (গড়) 27.68s 6.34s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 199.66s 20.69s
প্রতিক্রিয়া সময় (মোট) 581.26s 133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 xAI: Grok 4.20

medium
Cost
$0.041
Time
110.3s
Tokens
16,336 tok

#61 GLM 5.2

none
Invalid SVG
Cost
$0.033
Time
87.7s
Tokens
7,455 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
GLM 5.2 8.3 10.0 75.0% 0 3.70s 567 313 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
GLM 5.2 10.0 10.0 100.0% 0 20.69s 14,296 1,489 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
GLM 5.2 10.0 10.0 100.0% 0 7.17s 7,113 204 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
GLM 5.2 5.3 10.0 33.3% 0 6.50s 696 27 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
GLM 5.2 6.1 3.1 66.7% 1 4.42s 480 82 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
GLM 5.2 9.8 10.0 100.0% 0 3.84s 642 66 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
GLM 5.2 7.7 10.0 66.7% 0 3.31s 618 265 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
GLM 5.2 10.0 10.0 100.0% 0 15.76s 6,807 400 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442
GLM 5.2 3.0 10.0 0.0% 0 3.41s 189 13 0

দ্রুত তুলনা

তুলনার জুটি বদলান