নেভিগেশন
Advertise here

GPT-5.2 (medium) vs Grok 4.5 (medium)

Grok 4.5 (medium) average score-এ এগিয়ে: 8.5 vs 8.4. GPT-5.2 (medium)-এর benchmark খরচ কম: $1.182 vs $2.042. GPT-5.2 (medium) দ্রুত: 28.51s vs 68.59s, pass rates 72.7% vs 83.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#64
মোট আউটপুট টোকেন
71,252
প্রতিক্রিয়া সময় (গড়)
28.51s
মোট খরচ
$1.182
র‍্যাঙ্ক
#60
মোট আউটপুট টোকেন
299,460
প্রতিক্রিয়া সময় (গড়)
68.59s
মোট খরচ
$2.042
প্রস্তাবিত মডেল GPT-5.2 (medium)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than Grok 4.5 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.4 8.5
র‍্যাঙ্ক #64 #60
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 83.3%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.438 12.007
মোট খরচ $1.182 $2.042
ইনপুট মূল্য $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $14.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,013 122,155
আউটপুট টোকেন 9,914 5,514
রিজনিং টোকেন 61,338 293,946
প্রতিক্রিয়া সময় (গড়) 28.51s 68.59s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 116.86s 436.38s
প্রতিক্রিয়া সময় (মোট) 456.13s 1508.91s
প্যারামিটার ~1.2T মোট (~80B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#60 SpaceXAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান