নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.2 vs xAI: Grok 4.5

GPT-5.2 (medium) average score-এ এগিয়ে: 8.4 vs 8.3. GPT-5.2 (medium)-এর benchmark খরচ কম: $0.951 vs $1.928. GPT-5.2 (medium) দ্রুত: 22.62s vs 61.71s, pass rates 72.7% vs 78.8%.

প্রস্তাবিত মডেলGPT-5.2 (medium)It has the best score here (8.4), while costing about 2.0x less than Grok 4.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.4 8.3
র‍্যাঙ্ক #27 #28
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 78.8%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.791 12.049
মোট খরচ $0.951 $1.928
ইনপুট মূল্য $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $14.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,004 122,146
আউটপুট টোকেন 9,914 5,514
রিজনিং টোকেন 44,868 275,053
প্রতিক্রিয়া সময় (গড়) 22.62s 61.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 102.93s 436.38s
প্রতিক্রিয়া সময় (মোট) 339.28s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#28 xAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান