নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5.5 (medium) vs GPT-5.3-Codex (medium)

Claude Opus 5.5 (medium) average score-এ এগিয়ে: 9.2 vs 9.1. GPT-5.3-Codex (medium)-এর benchmark খরচ কম: $1.318 vs $1.804. GPT-5.3-Codex (medium) দ্রুত: 18.87s vs 25.85s, pass rates 89.9% vs 84.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-07

তুলনা করা মডেল

র‍্যাঙ্ক
#29
মোট আউটপুট টোকেন
32,127
প্রতিক্রিয়া সময় (গড়)
25.85s
মোট খরচ
$1.804
র‍্যাঙ্ক
#34
মোট আউটপুট টোকেন
66,287
প্রতিক্রিয়া সময় (গড়)
18.87s
মোট খরচ
$1.318
প্রস্তাবিত মডেল GPT-5.3-Codex (medium)

It offers the best overall trade-off: a competitive score (9.1), lower cost than Claude Opus 5.5 (medium), and balanced response time.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 5.5 Claude Opus 5.5 medium প্রকাশ: 2026-09-23 GPT-5.3-Codex GPT-5.3-Codex medium প্রকাশ: 2026-02-05
স্কোর 9.2 9.1
র‍্যাঙ্ক #29 #34
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.7 8.6
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 89.9% 84.1%
অস্থির টেস্ট 1 4
মোট রান 69 69
প্রতি ফলাফলে খরচ 9.016 7.753
মোট খরচ $1.804 $1.318
ইনপুট মূল্য $4.000 / 1M $1.750 / 1M
আউটপুট মূল্য $20.000 / 1M $14.000 / 1M
ক্যাশ পড়ার মূল্য $0.200 / 1M $0.175 / 1M
ক্যাশ লেখার মূল্য $5.000 / 1M প্রযোজ্য নয়
মোট ইনপুট টোকেন 290,117 222,794
আউটপুট টোকেন 9,805 7,357
রিজনিং টোকেন 22,322 58,930
প্রতিক্রিয়া সময় (গড়) 25.85s 18.87s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 90.20s 100.93s
প্রতিক্রিয়া সময় (মোট) 594.63s 433.94s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~1.2T মোট (~80B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5.5

medium
খরচ
$0.053
সময়
25.6s
টোকেন
2,781 tok

#34 GPT-5.3-Codex

medium
খরচ
$0.049
সময়
54.9s
টোকেন
3,580 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5.5 8.4 7.4 88.9% 1 13.50s 10,608 636 4,341
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

তুলনার জুটি বদলান