নেভিগেশন
AI BENCHY
Advertise here

OpenAI: GPT-5.3 Chat vs xAI: Grok 4.20

GPT-5.3 Chat average score-এ এগিয়ে: 7.5 vs 7.1. GPT-5.3 Chat-এর benchmark খরচ কম: $0.571 vs $0.777. GPT-5.3 Chat দ্রুত: 6.88s vs 29.47s, pass rates 68.2% vs 63.6%.

প্রস্তাবিত মডেলGPT-5.3 ChatIt has the best score here (7.5), while responding about 4.3x faster than Grok 4.20 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক GPT-5.3 Chat GPT-5.3 Chat none প্রকাশ: 2026-03-03 Grok 4.20 Grok 4.20 medium প্রকাশ: 2026-03-31
স্কোর 7.5 7.1
র‍্যাঙ্ক #62 #83
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 68.2% 63.6%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.387 9.709
মোট খরচ $0.571 $0.777
ইনপুট মূল্য $1.750 / 1M $1.250 / 1M
আউটপুট মূল্য $14.000 / 1M $2.500 / 1M
মোট ইনপুট টোকেন 78,990 102,791
আউটপুট টোকেন 30,854 5,363
রিজনিং টোকেন 0 253,977
প্রতিক্রিয়া সময় (গড়) 6.88s 29.47s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 18.33s 199.66s
প্রতিক্রিয়া সময় (মোট) 151.31s 648.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

#83 xAI: Grok 4.20

medium
খরচ
$0.041
সময়
110.3s
টোকেন
16,336 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

দ্রুত তুলনা

তুলনার জুটি বদলান