AI BENCHY
Advertise here
#187

Mistral Small 4

Mistral প্রকাশ: 2026-03-16 পরীক্ষিত হয়েছে: 2026-07-16 22:23 mistralai/mistral-small-2603::medium
(medium) (none)

সারাংশ

Mistral Small 4 AI BENCHY-তে 5.1 স্কোর করে এবং #187 স্থানে আছে। এর reliability 10.0, pass rate 42.4%, মোট খরচ $0.096, এবং গড় response time 10.77s.

Mistral Small 4 কে আলাদা করে যা: এটি অ্যান্টি-এআই কৌশল-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #2; আর ডেটা পার্সিং ও নিষ্কাশন এর দুর্বলতম ক্ষেত্র, rank #11.

ধারাবাহিকতা

7.0

মোট আউটপুট টোকেন

131,824

মোট ইনপুট টোকেন

140,494

ইনপুট মূল্য

$0.150 / 1M

আউটপুট মূল্য

$0.600 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 17

প্রতি চেষ্টায় পাস রেট: 42.4%

অস্থির টেস্ট

8

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

10.77s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 59.15s

প্রতিক্রিয়া সময় (মোট): 236.94s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
খরচ
$0.006
সময়
47.9s
টোকেন
9,857 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-07-16 22:23 নতুন টেস্ট যোগ হয়েছে 5.1 10.0 $0.096 বর্তমান রান
2026-06-04 13:43 নতুন টেস্ট যোগ হয়েছে 5.3 10.0 $0.068 তুলনা করুন
2026-05-22 00:16 স্যুইট পরিবর্তিত হয়েছে 5.4 10.0 $0.056 তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান 5.7 প্রযোজ্য নয় $0.034 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-04 15:40 $0.150 / 1M $0.600 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 5.6 3.8
কোডিং 4.4 5.1
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 7.3 5.9
ডোমেইন-নির্দিষ্ট 5.3 7.2
Sadharon Buddhimotta 4.8 10.0
নির্দেশনা অনুসরণ 7.3 5.8
ধাঁধা সমাধান 3.4 9.7
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল