নেভিগেশন
Advertise here

Claude Opus 5.5 (high) vs GPT-6.1 Sol (low)

GPT-6.1 Sol (low) average score-এ এগিয়ে: 9.5 vs 9.3. GPT-6.1 Sol (low)-এর benchmark খরচ কম: $0.275 vs $1.266. GPT-6.1 Sol (low) দ্রুত: 5.36s vs 25.88s, pass rates 86.4% vs 92.4%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-29

তুলনা করা মডেল

র‍্যাঙ্ক
#26
মোট আউটপুট টোকেন
36,457
প্রতিক্রিয়া সময় (গড়)
25.88s
মোট খরচ
$1.266
র‍্যাঙ্ক
#16
মোট আউটপুট টোকেন
11,879
প্রতিক্রিয়া সময় (গড়)
5.36s
মোট খরচ
$0.275
প্রস্তাবিত মডেল GPT-6.1 Sol (low)

It has the best score here (9.5), while costing about 4.6x less than Claude Opus 5.5 (high).

বিস্তারিত তুলনা

মেট্রিক Claude Opus 5.5 Claude Opus 5.5 high প্রকাশ: 2026-09-23 GPT-6.1 Sol GPT-6.1 Sol low প্রকাশ: 2026-09-29
স্কোর 9.3 9.5
র‍্যাঙ্ক #26 #16
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.3 9.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 86.4% 92.4%
অস্থির টেস্ট 2 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 7.029 1.375
মোট খরচ $1.266 $0.275
ইনপুট মূল্য $4.000 / 1M $2.000 / 1M
আউটপুট মূল্য $20.000 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 134,020 78,018
আউটপুট টোকেন 7,237 4,160
রিজনিং টোকেন 29,220 7,719
প্রতিক্রিয়া সময় (গড়) 25.88s 5.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 95.95s 29.38s
প্রতিক্রিয়া সময় (মোট) 569.33s 117.89s
প্যারামিটার ~5T মোট (~500B সক্রিয়) ~2T মোট (~150B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#26 Claude Opus 5.5

high
খরচ
$0.136
সময়
75.6s
টোকেন
6,934 tok

#16 GPT-6.1 Sol

low
খরচ
$0.028
সময়
44.6s
টোকেন
2,881 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Claude Opus 5.5 10.0 10.0 100.0% 0 13.44s 10,608 584 5,042
GPT-6.1 Sol 10.0 10.0 100.0% 0 4.48s 7,302 388 1,286

দ্রুত তুলনা

তুলনার জুটি বদলান