নেভিগেশন
AI BENCHY
Advertise here

GPT 5.3 Chat vs Grok Build 0.1 (medium)

average score প্রায় সমান: 7.5 vs 7.5. GPT 5.3 Chat-এর benchmark খরচ কম: $0.533 vs $1.130. GPT 5.3 Chat দ্রুত: 6.56s vs 54.50s, pass rates 65.2% vs 60.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-15

র‍্যাঙ্ক
#85
মোট আউটপুট টোকেন
28,179
প্রতিক্রিয়া সময় (গড়)
6.56s
মোট খরচ
$0.533
র‍্যাঙ্ক
#89
মোট আউটপুট টোকেন
511,406
প্রতিক্রিয়া সময় (গড়)
54.50s
মোট খরচ
$1.130
প্রস্তাবিত মডেল GPT 5.3 Chat

It has the best score here (7.5), while costing about 2.1x less than Grok Build 0.1 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT 5.3 Chat GPT 5.3 Chat none প্রকাশ: 2026-03-03 Grok Build 0.1 Grok Build 0.1 medium প্রকাশ: 2026-05-21
স্কোর 7.5 7.5
র‍্যাঙ্ক #85 #89
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 9.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 60.6%
অস্থির টেস্ট 4 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.097 8.691
মোট খরচ $0.533 $1.130
ইনপুট মূল্য $1.750 / 1M $1.000 / 1M
আউটপুট মূল্য $14.000 / 1M $2.000 / 1M
মোট ইনপুট টোকেন 78,846 106,946
আউটপুট টোকেন 28,179 7,993
রিজনিং টোকেন 0 503,413
প্রতিক্রিয়া সময় (গড়) 6.56s 54.50s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.33s 252.69s
প্রতিক্রিয়া সময় (মোট) 137.77s 1199.07s
প্যারামিটার ~400B মোট (~17B সক্রিয়) ~300B মোট (~30B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 GPT 5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

#89 SpaceXAI: Grok Build 0.1

medium
খরচ
$0.028
সময়
81.3s
টোকেন
14,009 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

দ্রুত তুলনা

তুলনার জুটি বদলান