নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (high) average score-এ এগিয়ে: 9.4 vs 9.2. GPT-5.6 Sol (high)-এর benchmark খরচ কম: $1.234 vs $1.486. Claude Opus 5 (medium) দ্রুত: 9.38s vs 11.73s, pass rates 83.3% vs 89.4%.

প্রস্তাবিত মডেলGPT-5.6 Sol (high)It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 medium প্রকাশ: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol high প্রকাশ: 2026-07-09
স্কোর 9.2 9.4
র‍্যাঙ্ক #12 #8
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 89.4%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.253 6.852
মোট খরচ $1.486 $1.234
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,607 79,249
আউটপুট টোকেন 25,673 4,855
রিজনিং টোকেন 6,930 23,044
প্রতিক্রিয়া সময় (গড়) 9.38s 11.73s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.05s 54.79s
প্রতিক্রিয়া সময় (মোট) 206.26s 257.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
খরচ
$0.125
সময়
69.3s
টোকেন
5,134 tok

#8 GPT-5.6 Sol

high
খরচ
$0.151
সময়
201.9s
টোকেন
5,100 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

দ্রুত তুলনা

তুলনার জুটি বদলান