নেভিগেশন
AI BENCHY
Advertise here

GPT-5.5 (medium) vs Grok 4.5 (high)

average score প্রায় সমান: 9.0 vs 9.0. Grok 4.5 (high)-এর benchmark খরচ কম: $2.252 vs $4.163. GPT-5.5 (medium) দ্রুত: 38.97s vs 72.30s, pass rates 87.9% vs 86.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-29

র‍্যাঙ্ক
#19
মোট আউটপুট টোকেন
125,316
প্রতিক্রিয়া সময় (গড়)
38.97s
মোট খরচ
$4.163
র‍্যাঙ্ক
#21
মোট আউটপুট টোকেন
324,462
প্রতিক্রিয়া সময় (গড়)
72.30s
মোট খরচ
$2.252
প্রস্তাবিত মডেল Grok 4.5 (high)

It has the best score here (9.0), while costing about 1.8x less than GPT-5.5 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24 Grok 4.5 Grok 4.5 high প্রকাশ: 2026-07-08
স্কোর 9.0 9.0
র‍্যাঙ্ক #19 #21
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.9 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 87.9% 86.4%
অস্থির টেস্ট 3 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 23.127 12.565
মোট খরচ $4.163 $2.252
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M
আউটপুট মূল্য $30.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 80,668 152,175
আউটপুট টোকেন 5,617 5,655
রিজনিং টোকেন 119,699 318,807
প্রতিক্রিয়া সময় (গড়) 38.97s 72.30s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 332.10s 676.83s
প্রতিক্রিয়া সময় (মোট) 857.43s 1590.56s
প্যারামিটার ~1.5T মোট (~100B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 GPT-5.5

medium
খরচ
$0.112
সময়
71.9s
টোকেন
3,807 tok

#21 SpaceXAI: Grok 4.5

high
খরচ
$0.015
সময়
29.7s
টোকেন
2,737 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

দ্রুত তুলনা

তুলনার জুটি বদলান