AI BENCHY
Advertise here
#101

Gemma 4 31B

Google প্রকাশ: 2026-04-02 পরীক্ষিত হয়েছে: 2026-06-04 14:04 google/gemma-4-31b-it::none
(medium) (none)

সারাংশ

Gemma 4 31B AI BENCHY-তে 6.1 স্কোর করে এবং #101 স্থানে আছে। এর reliability 10.0, pass rate 47.6%, মোট খরচ $0.004, এবং গড় response time 4.05s.

Gemma 4 31B কে আলাদা করে যা: এটি অ্যান্টি-এআই কৌশল-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #4; আর টুল কলিং এর দুর্বলতম ক্ষেত্র, rank #14. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

ধারাবাহিকতা

10.0

মোট খরচ (বর্তমান মূল্য)

$0.004 ↓ -10.0%

পরীক্ষার সময়: $0.004

মোট আউটপুট টোকেন

1,407

মোট ইনপুট টোকেন

20,911

ইনপুট মূল্য

$0.120 / 1M

আউটপুট মূল্য

$0.350 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 11

প্রতি চেষ্টায় পাস রেট: 47.6%

অস্থির টেস্ট

0

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

4.05s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 26.13s

প্রতিক্রিয়া সময় (মোট): 76.87s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 Gemma 4 31B

none
খরচ
$0.001
সময়
12.8s
টোকেন
795 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-06-04 14:04 নতুন টেস্ট যোগ হয়েছে 6.5 10.0 $0.004 বর্তমান রান
2026-05-22 00:30 স্যুইট পরিবর্তিত হয়েছে 6.7 10.0 $0.003 তুলনা করুন
2026-04-14 00:56 প্রথম নথিভুক্ত রান 6.9 প্রযোজ্য নয় $0.003 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-04 15:40 $0.120 / 1M $0.370 / 1M
2026-06-05 23:32 $0.120 / 1M $0.360 / 1M
2026-06-12 18:42 $0.120 / 1M $0.350 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 6.5 10.0
কোডিং 5.5 10.0
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 7.7 10.0
Sadharon Buddhimotta 10.0 10.0
নির্দেশনা অনুসরণ 6.5 10.0
ধাঁধা সমাধান 6.5 10.0
টুল কলিং 3.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল