নেভিগেশন
AI BENCHY
Advertise here

Claude Opus 5 vs OpenAI: GPT-5.6 Sol

GPT-5.6 Sol (low) average score-এ এগিয়ে: 9.5 vs 9.2. GPT-5.6 Sol (low)-এর benchmark খরচ কম: $0.971 vs $1.486. GPT-5.6 Sol (low) দ্রুত: 8.79s vs 9.38s, pass rates 83.3% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.6 Sol (low)It has the best score here (9.5), while costing about 1.5x less than Claude Opus 5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক Claude Opus 5 Claude Opus 5 medium প্রকাশ: 2026-07-25 GPT-5.6 Sol GPT-5.6 Sol low প্রকাশ: 2026-07-09
স্কোর 9.2 9.5
র‍্যাঙ্ক #12 #5
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 9.2
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 83.3% 86.4%
অস্থির টেস্ট 1 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.253 5.391
মোট খরচ $1.486 $0.971
ইনপুট মূল্য $5.000 / 1M $5.000 / 1M
আউটপুট মূল্য $25.000 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 135,607 78,571
আউটপুট টোকেন 25,673 4,476
রিজনিং টোকেন 6,930 14,770
প্রতিক্রিয়া সময় (গড়) 9.38s 8.79s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.05s 53.91s
প্রতিক্রিয়া সময় (মোট) 206.26s 193.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
খরচ
$0.125
সময়
69.3s
টোকেন
5,134 tok

#5 GPT-5.6 Sol

low
খরচ
$0.062
সময়
26.7s
টোকেন
2,150 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
GPT-5.6 Sol 10.0 10.0 100.0% 0 11.25s 7,302 412 3,482

দ্রুত তুলনা

তুলনার জুটি বদলান