নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Grok 4.6 (medium)

GPT-5.2 (medium) average score-এ এগিয়ে: 8.4 vs 8.3. GPT-5.2 (medium)-এর benchmark খরচ কম: $0.951 vs $1.656. GPT-5.2 (medium) দ্রুত: 22.62s vs 71.86s, pass rates 72.7% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-12

র‍্যাঙ্ক
#36
মোট আউটপুট টোকেন
54,782
প্রতিক্রিয়া সময় (গড়)
22.62s
মোট খরচ
$0.951
র‍্যাঙ্ক
#40
মোট আউটপুট টোকেন
240,338
প্রতিক্রিয়া সময় (গড়)
71.86s
মোট খরচ
$1.656
প্রস্তাবিত মডেল GPT-5.2 (medium)

It has the best score here (8.4), while costing about 1.7x less than Grok 4.6 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Grok 4.6 Grok 4.6 medium প্রকাশ: 2026-08-12
স্কোর 8.4 8.3
র‍্যাঙ্ক #36 #40
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 80.3%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.791 11.038
মোট খরচ $0.951 $1.656
ইনপুট মূল্য $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $14.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,004 106,778
আউটপুট টোকেন 9,914 4,811
রিজনিং টোকেন 44,868 235,527
প্রতিক্রিয়া সময় (গড়) 22.62s 71.86s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 102.93s 514.35s
প্রতিক্রিয়া সময় (মোট) 339.28s 1580.96s
প্যারামিটার ~1.2T মোট (~80B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#36 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#40 SpaceXAI: Grok 4.6

medium
খরচ
$0.028
সময়
72.1s
টোকেন
4,771 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226

দ্রুত তুলনা

তুলনার জুটি বদলান