Advertise here
#120

Claude Haiku 5.5

Anthropic প্রকাশ: 2026-10-07 পরীক্ষিত হয়েছে: 2026-10-07 21:50 anthropic/claude-haiku-5.5::medium
~50Bঘনবন্ধ উৎসআনুমানিক

সারাংশ

Claude Haiku 5.5 AI BENCHY-তে 7.7 স্কোর করে এবং #120 স্থানে আছে। এর reliability 10.0, pass rate 71.0%, মোট খরচ $0.063, এবং গড় response time 7.71s.

Claude Haiku 5.5 কে আলাদা করে যা: এটি নির্দেশনা অনুসরণ-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর Sadharon Buddhimotta এর দুর্বলতম ক্ষেত্র, rank #17. একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

মডেলের তথ্য

গবেষণার তারিখ: 2026-10-07

আনুমানিক
প্যারামিটার
~50B
আর্কিটেকচার
ঘন
উপলভ্যতা
বন্ধ উৎস
লাইসেন্স
-

সর্বজনীন তথ্যপ্রমাণের ভিত্তিতে সেরা অনুমান; প্রদানকারী সব মান প্রকাশ করেনি।

ধারাবাহিকতা

7.5

মোট আউটপুট টোকেন

66,174

মোট ইনপুট টোকেন

298,334

ইনপুট মূল্য

$0.100 / 1M

আউটপুট মূল্য

$0.500 / 1M

ক্যাশ পড়ার মূল্য

$0.010 / 1M

ক্যাশ লেখার মূল্য

$0.125 / 1M

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

সঠিক টেস্ট

ভুল টেস্ট: 10

প্রতি চেষ্টায় পাস রেট: 71.0%

অস্থির টেস্ট

7

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

7.71s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 47.70s

প্রতিক্রিয়া সময় (মোট): 177.29s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Claude Haiku 5.5

medium
খরচ
$0.002
সময়
17.2s
টোকেন
3,524 tok

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
স্বায়ত্তশাসিত এজেন্টের কাজ 10.0 10.0
অ্যান্টি-এআই কৌশল 8.7 7.9
কোডিং 6.3 4.8
সমন্বিত 7.3 5.8
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 2.9 4.4
Sadharon Buddhimotta 3.8 2.5
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 7.7 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল