AI BENCHY
Advertise here
#133

North Mini Code

Cohere প্রকাশ: 2026-06-18 পরীক্ষিত হয়েছে: 2026-07-16 23:46 cohere/north-mini-code::medium
(medium) (none)

সারাংশ

North Mini Code AI BENCHY-তে 5.9 স্কোর করে এবং #133 স্থানে আছে। এর reliability 8.6, pass rate 48.5%, মোট খরচ $0.000, এবং গড় response time 137.11s.

North Mini Code কে আলাদা করে যা: এটি অ্যান্টি-এআই কৌশল-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #2; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #9. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। এটি অস্বাভাবিকভাবে বেশি reasoning tokens ব্যবহার করে, যা ধীর বা বেশি খরচের runs ব্যাখ্যা করতে পারে।

ধারাবাহিকতা

8.5

মোট আউটপুট টোকেন

1,766,801

মোট ইনপুট টোকেন

81,813

ইনপুট মূল্য

$0.000 / 1M

আউটপুট মূল্য

$0.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 13

প্রতি চেষ্টায় পাস রেট: 48.5%

অস্থির টেস্ট

4

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

137.11s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 786.72s

প্রতিক্রিয়া সময় (মোট): 3016.42s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 North Mini Code

medium
খরচ
$0.000
সময়
51.8s
টোকেন
12,460 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-07-16 23:46 নতুন টেস্ট যোগ হয়েছে 5.9 8.6 $0.000 বর্তমান রান
2026-06-18 09:44 প্রথম রান 5.8 8.5 $0.000 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-18 09:34 $0.000 / 1M $0.000 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 8.4 10.0
কোডিং 4.5 4.9
সমন্বিত 2.9 5.8
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 7.2
Sadharon Buddhimotta 5.1 10.0
নির্দেশনা অনুসরণ 9.8 10.0
ধাঁধা সমাধান 3.3 10.0
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল