নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

xAI: Grok 4.20 vs Z.ai: GLM 4.7 Flash

সারাংশ

Grok 4.20 vs GLM 4.7 Flash benchmark তুলনা: Grok 4.20 average score-এ এগিয়ে: 4.4 vs 4.3. GLM 4.7 Flash-এর benchmark খরচ কম: $0.054 vs $0.057. Grok 4.20 দ্রুত: 1.11s vs 35.10s, pass rates 28.6% vs 33.3%.

প্রস্তাবিত মডেল: Grok 4.20 - It has the best score here (4.4), while responding about 31.6x faster than GLM 4.7 Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-02

মেট্রিক Grok 4.20 Grok 4.20 none প্রকাশ: 2026-03-31 GLM 4.7 Flash GLM 4.7 Flash medium প্রকাশ: 2026-01-19
স্কোর 4.4 4.3
র‍্যাঙ্ক #160 #162
নির্ভরযোগ্যতা প্রযোজ্য নয় 6.7
ধারাবাহিকতা 8.5 6.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 28.6% 33.3%
অস্থির টেস্ট 0 8
মোট রান 54 63
প্রতি ফলাফলে খরচ 1.570 1.337
মোট খরচ $0.057 $0.054
ইনপুট মূল্য $1.250 / 1M $0.060 / 1M
আউটপুট মূল্য $2.500 / 1M $0.400 / 1M
মোট ইনপুট টোকেন 41,313 37,206
আউটপুট টোকেন 1,923 43,754
রিজনিং টোকেন 0 89,079
প্রতিক্রিয়া সময় (গড়) 1.11s 35.10s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 6.04s 174.55s
প্রতিক্রিয়া সময় (মোট) 19.96s 456.24s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#160 xAI: Grok 4.20

none
খরচ
$0.004
সময়
6.5s
টোকেন
1,367 tok

#162 GLM 4.7 Flash

medium
অবৈধ SVG
খরচ
$0.000
সময়
186.2s
টোকেন
12,112 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 555 1,122 6,110
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 17,185 2,585 20,648
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 7,107 584 2,755
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 643 33,000 25,394
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 318 18 2,138
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 636 388 2,181
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.93s 521 781 5,255
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 6,949 224 1,014
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 0.0 0.0 0.0% 0 0ms 0 0 0
GLM 4.7 Flash 3.0 10.0 0.0% 0 11.13s 186 71 1,197

দ্রুত তুলনা

তুলনার জুটি বদলান