সারাংশ
Claude Opus 5.5 AI BENCHY-তে 1.8 স্কোর করে এবং #359 স্থানে আছে। এর reliability 10.0, pass rate 4.6%, মোট খরচ $0.015, এবং গড় response time 13.58s.
Claude Opus 5.5 কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।
আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।
মডেলের তথ্য
গবেষণার তারিখ: 2026-09-23
- প্যারামিটার
- ~5T মোট (~500B সক্রিয়)
- আর্কিটেকচার
- MoE
- উপলভ্যতা
- বন্ধ উৎস
- লাইসেন্স
- -
সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।
1.8
ধারাবাহিকতা
5.0
10.0
$0.015
মোট আউটপুট টোকেন
735
মোট ইনপুট টোকেন
73
ইনপুট মূল্য
$4.000 / 1M
আউটপুট মূল্য
$20.000 / 1M
অস্থির টেস্ট
0
অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।
চার্ট
প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।
স্কোর vs মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
| বিভাগ | স্কোর | ধারাবাহিকতা | সঠিক টেস্ট |
|---|---|---|---|
| অ্যান্টি-এআই কৌশল | 0.0 | 0.0 | |
| কোডিং | 0.0 | 0.0 | |
| সমন্বিত | 0.0 | 0.0 | |
| ডেটা পার্সিং ও নিষ্কাশন | 0.0 | 0.0 | |
| ডোমেইন-নির্দিষ্ট | 3.3 | 3.3 | |
| Sadharon Buddhimotta | 0.0 | 0.0 | |
| নির্দেশনা অনুসরণ | 0.0 | 0.0 | |
| ধাঁধা সমাধান | 0.0 | 0.0 | |
| টুল কলিং | 0.0 | 0.0 | |
| সাধারণ জ্ঞান | 0.0 | 0.0 |