নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.3 (medium) vs GLM 5.1 (medium)

average score প্রায় সমান: 7.1 vs 7.1. GLM 5.1 (medium)-এর benchmark খরচ কম: $0.535 vs $0.779. GLM 5.1 (medium) দ্রুত: 46.77s vs 47.45s, pass rates 68.2% vs 69.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#83
মোট আউটপুট টোকেন
241,421
প্রতিক্রিয়া সময় (গড়)
47.45s
মোট খরচ
$0.779
র‍্যাঙ্ক
#84
মোট আউটপুট টোকেন
152,552
প্রতিক্রিয়া সময় (গড়)
46.77s
মোট খরচ
$0.535
প্রস্তাবিত মডেল GLM 5.1 (medium)

It has the strongest score in this comparison (7.1) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Grok 4.3 Grok 4.3 medium প্রকাশ: 2026-05-01 GLM 5.1 GLM 5.1 medium প্রকাশ: 2026-04-07
স্কোর 7.1 7.1
র‍্যাঙ্ক #83 #84
নির্ভরযোগ্যতা 10.0 8.3
ধারাবাহিকতা 8.6 8.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 69.7%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.990 4.202
মোট খরচ $0.779 $0.535
ইনপুট মূল্য $1.250 / 1M $0.966 / 1M
আউটপুট মূল্য $2.500 / 1M $3.036 / 1M
মোট ইনপুট টোকেন 140,031 82,623
আউটপুট টোকেন 13,739 16,089
রিজনিং টোকেন 227,682 136,463
প্রতিক্রিয়া সময় (গড়) 47.45s 46.77s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 216.69s 308.75s
প্রতিক্রিয়া সময় (মোট) 1043.83s 982.16s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 xAI: Grok 4.3

medium
খরচ
$0.009
সময়
19.0s
টোকেন
3,661 tok

#84 GLM 5.1

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

দ্রুত তুলনা

তুলনার জুটি বদলান