নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.3-Codex

Claude Opus 5 (high) average score-এ এগিয়ে: 9.2 vs 8.9. GPT-5.3-Codex (medium)-এর benchmark খরচ কম: $0.920 vs $2.835. GPT-5.3-Codex (medium) দ্রুত: 16.96s vs 20.44s, pass rates 84.9% vs 83.3%.

প্রস্তাবিত মডেলGPT-5.3-Codex (medium)Its score stays close to the best score here (8.9 vs 9.2), while costing about 3.1x less than Claude Opus 5 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25 GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05
স্কোর 9.2 8.9
র‍্যাঙ্ক #11 #18
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 84.9% 83.3%
অস্থির টেস্ট 1 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 15.747 5.748
মোট খরচ $2.835 $0.920
ইনপুট মূল্য $5.000 / 1M $1.750 / 1M
আউটপুট মূল্য $25.000 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 135,959 81,268
আউটপুট টোকেন 67,066 6,251
রিজনিং টোকেন 19,114 49,274
প্রতিক্রিয়া সময় (গড়) 20.44s 16.96s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 159.01s 100.93s
প্রতিক্রিয়া সময় (মোট) 449.68s 373.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

#18 GPT-5.3-Codex

medium
খরচ
$0.049
সময়
54.9s
টোকেন
3,580 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

দ্রুত তুলনা

তুলনার জুটি বদলান