নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.5

Claude Opus 5 (medium) average score-এ এগিয়ে: 9.2 vs 9.0. Claude Opus 5 (medium)-এর benchmark খরচ কম: $1.486 vs $4.137. Claude Opus 5 (medium) দ্রুত: 9.38s vs 38.42s, pass rates 83.3% vs 87.9%.

প্রস্তাবিত মডেলClaude Opus 5 (medium)It has the best score here (9.2), while costing about 2.8x less than GPT-5.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 medium প্রকাশ: 2026-07-25 GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24
স্কোর 9.2 9.0
র‍্যাঙ্ক #12 #15
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 87.9%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.253 22.980
মোট খরচ $1.486 $4.137
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,607 80,659
আউটপুট টোকেন 25,673 5,617
রিজনিং টোকেন 6,930 118,819
প্রতিক্রিয়া সময় (গড়) 9.38s 38.42s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.05s 332.10s
প্রতিক্রিয়া সময় (মোট) 206.26s 845.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
খরচ
$0.125
সময়
69.3s
টোকেন
5,134 tok

#15 GPT-5.5

medium
খরচ
$0.112
সময়
71.9s
টোকেন
3,807 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

দ্রুত তুলনা

তুলনার জুটি বদলান