#51

Gemini 3.1 Flash Lite

Google প্রকাশ: 2026-05-08 পরীক্ষিত হয়েছে: 2026-05-22 00:26 google/gemini-3.1-flash-lite::low

(high) (medium) (low) (minimal) (none)

সারাংশ

Gemini 3.1 Flash Lite AI BENCHY-তে 7.4 স্কোর করে এবং #51 স্থানে আছে। এর reliability 10.0, pass rate 65.0%, মোট খরচ $0.026, এবং গড় response time 1.92s.

Gemini 3.1 Flash Lite কে আলাদা করে যা: এটি কোডিং-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #2; আর সমন্বিত এর দুর্বলতম ক্ষেত্র, rank #14. এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম। একই ধরনের মডেলের তুলনায় এটি লক্ষণীয়ভাবে দ্রুত।

পরিচয় নোট

Google: Gemini 3.1 Flash Lite Preview ছিল Gemini 3.1 Flash Lite-এর প্রিভিউ সংস্করণ।

স্কোর

7.4

ধারাবাহিকতা

9.2

নির্ভরযোগ্যতা

10.0

মোট খরচ (বর্তমান মূল্য)

$0.026

মোট আউটপুট টোকেন

11,677

মোট ইনপুট টোকেন

ইনপুট মূল্য

$0.250 / 1M

আউটপুট মূল্য

$1.500 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 8

প্রতি চেষ্টায় পাস রেট: 65.0%

অস্থির টেস্ট

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

1.92s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 5.66s

প্রতিক্রিয়া সময় (মোট): 38.45s

ভুল উত্তর: 8

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 Gemini 3.1 Flash Lite

low

খরচ: $0.003
সময়: 4.0s
টোকেন: 1,479 tok

রান ইতিহাস

পরীক্ষিত হয়েছে	স্কোর	নির্ভরযোগ্যতা	মোট খরচ	তুলনা করুন
2026-06-04 14:00 নতুন টেস্ট যোগ হয়েছে	7.2	10.0	$0.028	তুলনা করুন
2026-05-22 00:26 স্যুইট পরিবর্তিত হয়েছে	7.4	10.0	$0.026	বর্তমান রান
2026-05-08 12:01 প্রথম রান	7.9	10.0	$0.024	তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

রান তুলনা

রান	স্কোর	ধারাবাহিকতা	নির্ভরযোগ্যতা	সঠিক টেস্ট	অস্থির টেস্ট	মোট আউটপুট টোকেন	মোট খরচ	প্রতিক্রিয়া সময় (গড়)
2026-05-22 00:26 · স্যুইট পরিবর্তিত হয়েছে	7.4	9.2	10.0	12/20	2	11,677	$0.026	1.92s
2026-05-08 12:01 · প্রথম রান	7.9	9.2	10.0	12/18	2	10,869	$0.024	1.95s
পার্থক্য	-0.5	0.0	0.0	0	0	+808	+$0.003	-23ms

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

Gemini 3.1 Flash LitelowvsMiMo-V2.5medium Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium Gemini 3.1 Flash Litelowvsgpt-oss-120bmediumবিনামূল্যে উপলভ্য Gemini 3.1 Flash LitelowvsGemini 3.5 Flashhigh Gemini 3.1 Flash LitelowvsGemini 3 Flash Previewmedium Gemini 3.1 Flash LitelowvsNemotron 3 Ultra 550b A55bmediumবিনামূল্যে উপলভ্য Gemini 3.1 Flash LitelowvsGPT-5.5low

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ	স্কোর	ধারাবাহিকতা
অ্যান্টি-এআই কৌশল	7.3	6.2
কোডিং	6.8	10.0
সমন্বিত	3.0	10.0
ডেটা পার্সিং ও নিষ্কাশন	10.0	10.0
ডোমেইন-নির্দিষ্ট	5.3	10.0
Sadharon Buddhimotta	4.0	10.0
নির্দেশনা অনুসরণ	10.0	10.0
ধাঁধা সমাধান	10.0	10.0
টুল কলিং	10.0	10.0
সাধারণ জ্ঞান	3.0	10.0

Gemini 3.1 Flash Lite

Hamster playing table tennis

#51 Gemini 3.1 Flash Lite

চার্ট

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর vs মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

তুলনা করা মডেল