Advertise here
#35

Claude Haiku 5.5

Anthropic প্রকাশ: 2026-10-07 পরীক্ষিত হয়েছে: 2026-10-07 21:50 anthropic/claude-haiku-5.5::xhigh
~50Bঘনবন্ধ উৎসআনুমানিক

সারাংশ

Claude Haiku 5.5 AI BENCHY-তে 9.1 স্কোর করে এবং #35 স্থানে আছে। এর reliability 10.0, pass rate 81.2%, মোট খরচ $0.140, এবং গড় response time 16.58s.

Claude Haiku 5.5 কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

মডেলের তথ্য

গবেষণার তারিখ: 2026-10-07

আনুমানিক
প্যারামিটার
~50B
আর্কিটেকচার
ঘন
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

9.3

মোট আউটপুট টোকেন

199,268

মোট ইনপুট টোকেন

394,509

ইনপুট মূল্য

$0.100 / 1M

আউটপুট মূল্য

$0.500 / 1M

ক্যাশ পড়ার মূল্য

$0.010 / 1M

ক্যাশ লেখার মূল্য

$0.125 / 1M

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 5

প্রতি চেষ্টায় পাস রেট: 81.2%

অস্থির টেস্ট

2

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

16.58s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 92.74s

প্রতিক্রিয়া সময় (মোট): 381.40s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#35 Claude Haiku 5.5

xhigh
খরচ
$0.021
সময়
189.0s
টোকেন
41,343 tok

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
স্বায়ত্তশাসিত এজেন্টের কাজ 10.0 10.0
অ্যান্টি-এআই কৌশল 10.0 10.0
কোডিং 10.0 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 7.2
Sadharon Buddhimotta 5.0 10.0
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 7.6 7.2
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল