AI BENCHY
Advertise here

#78

DeepSeek V4 Pro

DeepSeek প্রকাশ: 2026-04-24 পরীক্ষিত হয়েছে: 2026-04-29 14:46 deepseek/deepseek-v4-pro::none
(high) (none)

ধারাবাহিকতা

8.7

মোট আউটপুট টোকেন

3,903

ইনপুট মূল্য

$0.435 / 1M

আউটপুট মূল্য

$0.870 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 11

প্রতি চেষ্টায় পাস রেট: 48.2%

অস্থির টেস্ট

3

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

14.01s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 58.65s

প্রতিক্রিয়া সময় (মোট): 252.12s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-22 00:38 স্যুইট পরিবর্তিত হয়েছে 6.0 8.1 $0.046 তুলনা করুন
2026-04-29 14:46 পুনরায় পরীক্ষা 6.2 7.9 $0.043 বর্তমান রান
2026-04-24 09:19 প্রথম রান 3.1 প্রযোজ্য নয় $0.009 তুলনা করুন

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-29 14:46 · পুনরায় পরীক্ষা6.28.77.97/1833,903$0.04314.01s
2026-04-24 09:19 · প্রথম রান3.17.2প্রযোজ্য নয়0/186591$0.00944.40s
পার্থক্য+3.1+1.5+7-3+3312+$0.034-30391ms

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.5 8.0
কোডিং 7.1 3.7
সমন্বিত 9.5 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 5.3 10.0
Sadharon Buddhimotta 4.3 9.9
নির্দেশনা অনুসরণ 6.3 10.0
ধাঁধা সমাধান 6.0 7.1
টুল কলিং 10.0 10.0

তুলনা করা মডেল