নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (low) average score-এ এগিয়ে: 9.5 vs 9.2. GPT-5.6 Sol (low)-এর benchmark খরচ কম: $0.971 vs $2.835. GPT-5.6 Sol (low) দ্রুত: 8.79s vs 20.44s, pass rates 84.9% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.6 Sol (low)It has the best score here (9.5), while costing about 2.9x less than Claude Opus 5 (high).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol low প্রকাশ: 2026-07-09
স্কোর 9.2 9.5
র‍্যাঙ্ক #11 #5
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 84.9% 86.4%
অস্থির টেস্ট 1 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 15.747 5.391
মোট খরচ $2.835 $0.971
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,959 78,571
আউটপুট টোকেন 67,066 4,476
রিজনিং টোকেন 19,114 14,770
প্রতিক্রিয়া সময় (গড়) 20.44s 8.79s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 159.01s 53.91s
প্রতিক্রিয়া সময় (মোট) 449.68s 193.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#11 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

#5 GPT-5.6 Sol

low
খরচ
$0.062
সময়
26.7s
টোকেন
2,150 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

দ্রুত তুলনা

তুলনার জুটি বদলান