AI BENCHY
Advertise here

#12

Gemini 3.1 Flash Lite Preview

Google প্রকাশ: 2026-03-03 পরীক্ষিত হয়েছে: 2026-04-10 23:27 google/gemini-3.1-flash-lite-preview::high

আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।

পরিচয় নোট

Gemini 3.1 Flash Lite Preview ছিল Google: Gemini 3.1 Flash Lite-এর প্রিভিউ সংস্করণ।

ধারাবাহিকতা

9.6

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

1,534,593

ইনপুট মূল্য

$0.250 / 1M

আউটপুট মূল্য

$1.500 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 4

প্রতি চেষ্টায় পাস রেট: 77.1%

অস্থির টেস্ট

1

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

68.83s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 280.52s

প্রতিক্রিয়া সময় (মোট): 1101.32s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-06 14:01 পুনরায় পরীক্ষা 8.6 প্রযোজ্য নয় $2.310 তুলনা করুন
2026-05-06 14:01 স্যুইট পরিবর্তিত হয়েছে 8.6 প্রযোজ্য নয় $2.310 তুলনা করুন
2026-04-10 23:27 প্রথম নথিভুক্ত রান 8.4 প্রযোজ্য নয় $2.310 বর্তমান রান

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-10 23:27 · প্রথম নথিভুক্ত রান8.49.6প্রযোজ্য নয়12/1611,534,593$2.31068.83s
2026-05-06 14:01 · স্যুইট পরিবর্তিত হয়েছে8.610.0প্রযোজ্য নয়13/1601,534,593$2.31068.83s
পার্থক্য-0.2-0.4-1+10$0.0000ms

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 10.0 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 10.0 10.0
নির্দেশনা অনুসরণ 7.9 6.9
ধাঁধা সমাধান 7.7 10.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল