AI BENCHY
Advertise here

#1

Gemini 3 Flash Preview

Google প্রকাশ: 2025-12-17 পরীক্ষিত হয়েছে: 2026-05-06 13:38 google/gemini-3-flash-preview::medium
(medium) (low) (none)

ধারাবাহিকতা

9.6

মোট আউটপুট টোকেন

101,480

???? ???

$0.500 / 1M

????? ???

$3.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 1

প্রতি চেষ্টায় পাস রেট: 98.2%

অস্থির টেস্ট

1

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

11.53s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 74.66s

প্রতিক্রিয়া সময় (মোট): 207.46s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-06 13:52 স্যুইট পরিবর্তিত হয়েছে 10.0 10.0 $0.321 তুলনা করুন
2026-05-06 13:38 স্যুইট পরিবর্তিত হয়েছে 9.8 10.0 $0.320 বর্তমান রান
2026-04-23 15:25 পুনরায় পরীক্ষা 10.0 প্রযোজ্য নয় $0.108 তুলনা করুন
2026-04-11 01:44 প্রথম নথিভুক্ত রান 10.0 প্রযোজ্য নয় $0.314 তুলনা করুন

এই রানটি ভিন্ন একটি বেঞ্চমার্ক স্যুইট ব্যবহার করেছে। ঐতিহাসিক পরিবর্তন পড়ার সময় স্যুইট পরিবর্তনও মাথায় রাখুন।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 10.0 10.0
কোডিং 10.0 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 10.0 10.0
Sadharon Buddhimotta 10.0 10.0
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 9.0 7.9
টুল কলিং 10.0 10.0

তুলনা করা মডেল