নেভিগেশন
AI BENCHY
Advertise here

Grok 4.20 (medium) vs Grok 4.3 (medium)

average score প্রায় সমান: 7.1 vs 7.1. Grok 4.20 (medium)-এর benchmark খরচ কম: $0.777 vs $0.779. Grok 4.20 (medium) দ্রুত: 29.47s vs 47.45s, pass rates 63.6% vs 68.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-11

র‍্যাঙ্ক
#101
মোট আউটপুট টোকেন
259,340
প্রতিক্রিয়া সময় (গড়)
29.47s
মোট খরচ
$0.777
র‍্যাঙ্ক
#98
মোট আউটপুট টোকেন
241,421
প্রতিক্রিয়া সময় (গড়)
47.45s
মোট খরচ
$0.779
প্রস্তাবিত মডেল Grok 4.20 (medium)

It has the best score here (7.1), while responding about 1.6x faster than Grok 4.3 (medium).

বিস্তারিত তুলনা

মেট্রিক Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31 Grok 4.3 Grok 4.3 medium প্রকাশ: 2026-05-01
স্কোর 7.1 7.1
র‍্যাঙ্ক #101 #98
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.6
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 68.2%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 9.709 5.990
মোট খরচ $0.777 $0.779
ইনপুট মূল্য $1.250 / 1M $1.250 / 1M
আউটপুট মূল্য $2.500 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 102,791 140,031
আউটপুট টোকেন 5,363 13,739
রিজনিং টোকেন 253,977 227,682
প্রতিক্রিয়া সময় (গড়) 29.47s 47.45s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 199.66s 216.69s
প্রতিক্রিয়া সময় (মোট) 648.35s 1043.83s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 xAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

#98 xAI: Grok 4.3

medium
খরচ
$0.009
সময়
19.0s
টোকেন
3,661 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226

দ্রুত তুলনা

তুলনার জুটি বদলান