নেভিগেশন
AI BENCHY
Advertise here

GPT-5.5 vs Grok 4.20 (medium)

average score প্রায় সমান: 7.0 vs 7.0. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $0.805. GPT-5.5 দ্রুত: 2.35s vs 32.56s, pass rates 59.1% vs 60.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#118
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.35s
মোট খরচ
$0.544
র‍্যাঙ্ক
#120
মোট আউটপুট টোকেন
270,259
প্রতিক্রিয়া সময় (গড়)
32.56s
মোট খরচ
$0.805
প্রস্তাবিত মডেল GPT-5.5

It has the best score here (7.0), while responding about 13.8x faster than Grok 4.20 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24 Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31
স্কোর 7.0 7.0
র‍্যাঙ্ক #118 #120
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 59.1% 60.6%
অস্থির টেস্ট 2 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.533 10.365
মোট খরচ $0.544 $0.805
ইনপুট মূল্য $5.000 / 1M $1.250 / 1M
আউটপুট মূল্য $30.000 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 79,294 102,986
আউটপুট টোকেন 4,915 5,860
রিজনিং টোকেন 0 264,399
প্রতিক্রিয়া সময় (গড়) 2.35s 32.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 12.24s 199.66s
প্রতিক্রিয়া সময় (মোট) 51.78s 716.36s
প্যারামিটার ~1.5T মোট (~100B সক্রিয়) ~1T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

#120 SpaceXAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

দ্রুত তুলনা

তুলনার জুটি বদলান