নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 9.2. GPT-5.5 (low)-এর benchmark খরচ কম: $1.253 vs $2.835. GPT-5.5 (low) দ্রুত: 10.13s vs 20.44s, pass rates 84.9% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the best score here (9.3), while costing about 2.3x less than Claude Opus 5 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 9.2 9.3
র‍্যাঙ্ক #11 #9
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 84.9% 86.4%
অস্থির টেস্ট 1 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 15.747 6.594
মোট খরচ $2.835 $1.253
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,959 80,058
আউটপুট টোকেন 67,066 5,378
রিজনিং টোকেন 19,114 23,040
প্রতিক্রিয়া সময় (গড়) 20.44s 10.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 159.01s 56.19s
প্রতিক্রিয়া সময় (মোট) 449.68s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

#9 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান