AI BENCHY
Advertise here

#112

DeepSeek V4 Pro

DeepSeek প্রকাশ: 2026-04-24 পরীক্ষিত হয়েছে: 2026-04-24 09:19 deepseek/deepseek-v4-pro::none
(high) (none)

ধারাবাহিকতা

7.2

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

591

ইনপুট মূল্য

$1.740 / 1M

আউটপুট মূল্য

$3.480 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 18

প্রতি চেষ্টায় পাস রেট: 11.1%

অস্থির টেস্ট

6

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

44.40s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 125.71s

প্রতিক্রিয়া সময় (মোট): 577.18s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-22 00:38 স্যুইট পরিবর্তিত হয়েছে 6.0 8.1 $0.046 তুলনা করুন
2026-04-29 14:46 পুনরায় পরীক্ষা 6.2 7.9 $0.043 তুলনা করুন
2026-04-24 09:19 প্রথম রান 3.1 প্রযোজ্য নয় $0.009 বর্তমান রান

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.1 10.0
কোডিং 2.8 1.6
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 2.8 1.6
ডোমেইন-নির্দিষ্ট 3.0 10.0
Sadharon Buddhimotta 3.4 9.6
নির্দেশনা অনুসরণ 3.3 6.1
ধাঁধা সমাধান 3.6 4.3
টুল কলিং 3.0 10.0

তুলনা করা মডেল