Advertise here
#64

Claude Haiku 5.5

Anthropic প্রকাশ: 2026-10-07 পরীক্ষিত হয়েছে: 2026-10-07 21:50 anthropic/claude-haiku-5.5::low
~50Bঘনবন্ধ উৎসআনুমানিক

সারাংশ

Claude Haiku 5.5 AI BENCHY-তে 8.6 স্কোর করে এবং #64 স্থানে আছে। এর reliability 10.0, pass rate 76.8%, মোট খরচ $0.061, এবং গড় response time 7.51s.

Claude Haiku 5.5 কে আলাদা করে যা: এটি ডোমেইন-নির্দিষ্ট-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর Sadharon Buddhimotta এর দুর্বলতম ক্ষেত্র, rank #15. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

মডেলের তথ্য

গবেষণার তারিখ: 2026-10-07

আনুমানিক
প্যারামিটার
~50B
আর্কিটেকচার
ঘন
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

8.9

মোট আউটপুট টোকেন

61,650

মোট ইনপুট টোকেন

296,301

ইনপুট মূল্য

$0.100 / 1M

আউটপুট মূল্য

$0.500 / 1M

ক্যাশ পড়ার মূল্য

$0.010 / 1M

ক্যাশ লেখার মূল্য

$0.125 / 1M

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 7

প্রতি চেষ্টায় পাস রেট: 76.8%

অস্থির টেস্ট

3

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

7.51s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 44.43s

প্রতিক্রিয়া সময় (মোট): 172.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 Claude Haiku 5.5

low
খরচ
$0.001
সময়
7.4s
টোকেন
1,851 tok

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
স্বায়ত্তশাসিত এজেন্টের কাজ 10.0 10.0
অ্যান্টি-এআই কৌশল 8.7 7.9
কোডিং 7.9 7.5
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.9 7.2
Sadharon Buddhimotta 4.6 9.8
নির্দেশনা অনুসরণ 9.8 10.0
ধাঁধা সমাধান 7.7 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল