নেভিগেশন
Advertise here

Claude Opus 5 (high) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score-এ এগিয়ে: 9.5 vs 9.2. GPT-6.1 Sol (low)-এর benchmark খরচ কম: $0.275 vs $3.070. GPT-6.1 Sol (low) দ্রুত: 5.36s vs 22.51s, pass rates 81.8% vs 92.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-29

তুলনা করা মডেল

র‍্যাঙ্ক
#29
মোট আউটপুট টোকেন
95,583
প্রতিক্রিয়া সময় (গড়)
22.51s
মোট খরচ
$3.070
র‍্যাঙ্ক
#16
মোট আউটপুট টোকেন
11,879
প্রতিক্রিয়া সময় (গড়)
5.36s
মোট খরচ
$0.275
প্রস্তাবিত মডেল GPT-6.1 Sol (low)

It has the best score here (9.5), while costing about 11.2x less than Claude Opus 5 (high).

বিস্তারিত তুলনা

মেট্রিক Claude Opus 5 Claude Opus 5 high প্রকাশ: 2026-07-25 GPT-6.1 Sol GPT-6.1 Sol low প্রকাশ: 2026-09-29
স্কোর 9.2 9.5
র‍্যাঙ্ক #29 #16
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 9.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 92.4%
অস্থির টেস্ট 0 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 17.052 1.375
মোট খরচ $3.070 $0.275
ইনপুট মূল্য $5.000 / 1M $2.000 / 1M
আউটপুট মূল্য $25.000 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 135,956 78,018
আউটপুট টোকেন 64,624 4,160
রিজনিং টোকেন 30,959 7,719
প্রতিক্রিয়া সময় (গড়) 22.51s 5.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 159.01s 29.38s
প্রতিক্রিয়া সময় (মোট) 495.12s 117.89s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~2T মোট (~150B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#29 Claude Opus 5

high
খরচ
$0.265
সময়
144.5s
টোকেন
10,741 tok

#16 GPT-6.1 Sol

low
খরচ
$0.028
সময়
44.6s
টোকেন
2,881 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5 10.0 10.0 100.0% 0 12.73s 10,590 7,547 1,721
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

দ্রুত তুলনা

তুলনার জুটি বদলান