নেভিগেশন
AI BENCHY
Advertise here

GPT-5.2 (medium) vs Grok 4.5 (low)

average score প্রায় সমান: 8.4 vs 8.4. Grok 4.5 (low)-এর benchmark খরচ কম: $0.945 vs $1.182. Grok 4.5 (low) দ্রুত: 16.17s vs 28.51s, pass rates 72.7% vs 77.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-29

র‍্যাঙ্ক
#42
মোট আউটপুট টোকেন
71,252
প্রতিক্রিয়া সময় (গড়)
28.51s
মোট খরচ
$1.182
র‍্যাঙ্ক
#41
মোট আউটপুট টোকেন
115,489
প্রতিক্রিয়া সময় (গড়)
16.17s
মোট খরচ
$0.945
প্রস্তাবিত মডেল Grok 4.5 (low)

It has the best score here (8.4), while responding about 1.8x faster than GPT-5.2 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11 Grok 4.5 Grok 4.5 low প্রকাশ: 2026-07-08
স্কোর 8.4 8.4
র‍্যাঙ্ক #42 #41
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 9.3
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 77.3%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.438 5.901
মোট খরচ $1.182 $0.945
ইনপুট মূল্য $1.750 / 1M $2.000 / 1M
আউটপুট মূল্য $14.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,013 125,605
আউটপুট টোকেন 9,914 7,505
রিজনিং টোকেন 61,338 107,984
প্রতিক্রিয়া সময় (গড়) 28.51s 16.17s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 116.86s 205.28s
প্রতিক্রিয়া সময় (মোট) 456.13s 355.67s
প্যারামিটার ~1.2T মোট (~80B সক্রিয়) ~1.7T মোট (~170B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

#41 SpaceXAI: Grok 4.5

low
খরচ
$0.011
সময়
12.4s
টোকেন
2,018 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

দ্রুত তুলনা

তুলনার জুটি বদলান