নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (medium) average score-এ এগিয়ে: 9.4 vs 9.2. GPT-5.6 Sol (medium)-এর benchmark খরচ কম: $1.316 vs $1.486. Claude Opus 5 (medium) দ্রুত: 9.38s vs 11.35s, pass rates 83.3% vs 90.9%.

প্রস্তাবিত মডেলGPT-5.6 Sol (medium)It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 medium প্রকাশ: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol medium প্রকাশ: 2026-07-09
স্কোর 9.2 9.4
র‍্যাঙ্ক #12 #7
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 90.9%
অস্থির টেস্ট 1 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.253 7.311
মোট খরচ $1.486 $1.316
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,607 78,997
আউটপুট টোকেন 25,673 4,696
রিজনিং টোকেন 6,930 26,002
প্রতিক্রিয়া সময় (গড়) 9.38s 11.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.05s 79.40s
প্রতিক্রিয়া সময় (মোট) 206.26s 249.73s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
খরচ
$0.125
সময়
69.3s
টোকেন
5,134 tok

#7 GPT-5.6 Sol

medium
খরচ
$0.124
সময়
57.2s
টোকেন
4,199 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

দ্রুত তুলনা

তুলনার জুটি বদলান