নেভিগেশন
Advertise here

Claude Opus 4.8 vs GPT-6 Sol

Claude Opus 4.8 average score-এ এগিয়ে: 7.3 vs 7.2. GPT-6 Sol-এর benchmark খরচ কম: $0.280 vs $1.166. Claude Opus 4.8 দ্রুত: 4.92s vs 6.84s, pass rates 63.6% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#144
মোট আউটপুট টোকেন
16,797
প্রতিক্রিয়া সময় (গড়)
4.92s
মোট খরচ
$1.166
র‍্যাঙ্ক
#148
মোট আউটপুট টোকেন
6,696
প্রতিক্রিয়া সময় (গড়)
6.84s
মোট খরচ
$0.280
প্রস্তাবিত মডেল GPT-6 Sol

Its score stays close to the best score here (7.2 vs 7.3), while costing about 4.2x less than Claude Opus 4.8.

বিস্তারিত তুলনা

মেট্রিক Claude Opus 4.8 Claude Opus 4.8 none প্রকাশ: 2026-05-28 GPT-6 Sol GPT-6 Sol none প্রকাশ: 2026-09-23
স্কোর 7.3 7.2
র‍্যাঙ্ক #144 #148
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 66.7%
অস্থির টেস্ট 2 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 8.969 2.151
মোট খরচ $1.166 $0.280
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M
আউটপুট মূল্য $25.000 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 149,203 106,332
আউটপুট টোকেন 16,797 6,696
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 4.92s 6.84s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 35.03s 23.89s
প্রতিক্রিয়া সময় (মোট) 108.24s 150.43s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~2T মোট (~150B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#144 Claude Opus 4.8

none
খরচ
$0.053
সময়
22.0s
টোকেন
2,253 tok

#148 GPT-6 Sol

none
খরচ
$0.030
সময়
31.9s
টোকেন
3,055 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0

দ্রুত তুলনা

তুলনার জুটি বদলান