নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs OpenAI: GPT-5.5

Claude Opus 5 (high) average score-এ এগিয়ে: 9.2 vs 9.0. Claude Opus 5 (high)-এর benchmark খরচ কম: $2.835 vs $4.137. Claude Opus 5 (high) দ্রুত: 20.44s vs 38.42s, pass rates 84.9% vs 87.9%.

প্রস্তাবিত মডেলClaude Opus 5 (high)It has the best score here (9.2), while responding about 1.9x faster than GPT-5.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25 GPT-5.5 GPT-5.5 medium প্রকাশ: 2026-04-24
স্কোর 9.2 9.0
র‍্যাঙ্ক #11 #15
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 84.9% 87.9%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 15.747 22.980
মোট খরচ $2.835 $4.137
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,959 80,659
আউটপুট টোকেন 67,066 5,617
রিজনিং টোকেন 19,114 118,819
প্রতিক্রিয়া সময় (গড়) 20.44s 38.42s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 159.01s 332.10s
প্রতিক্রিয়া সময় (মোট) 449.68s 845.35s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

#15 GPT-5.5

medium
খরচ
$0.112
সময়
71.9s
টোকেন
3,807 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

দ্রুত তুলনা

তুলনার জুটি বদলান