AI BENCHY
Advertise here

#51

DeepSeek V4 Pro

DeepSeek প্রকাশ: 2026-04-24 পরীক্ষিত হয়েছে: 2026-04-29 14:47 deepseek/deepseek-v4-pro::high
(high) (none)

ধারাবাহিকতা

8.0

মোট আউটপুট টোকেন

62,125

ইনপুট মূল্য

$0.435 / 1M

আউটপুট মূল্য

$0.870 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 7

প্রতি চেষ্টায় পাস রেট: 73.2%

অস্থির টেস্ট

4

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

60.03s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 358.35s

প্রতিক্রিয়া সময় (মোট): 1080.60s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-22 00:54 স্যুইট পরিবর্তিত হয়েছে 6.6 9.0 $0.212 তুলনা করুন
2026-04-29 14:47 পুনরায় পরীক্ষা 7.5 9.3 $0.209 বর্তমান রান
2026-04-26 10:50 পুনরায় পরীক্ষা 7.5 8.4 $0.201 তুলনা করুন
2026-04-25 21:53 প্রথম রান 8.2 প্রযোজ্য নয় $0.329 তুলনা করুন

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-29 14:47 · পুনরায় পরীক্ষা7.58.09.311/18462,125$0.20960.03s
2026-04-25 21:53 · প্রথম রান8.29.2প্রযোজ্য নয়13/18284,562$0.32972.92s
পার্থক্য-0.7-1.2-2+2-22437-$0.120-12888ms

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 8.3 10.0
কোডিং 3.0 0.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 3.2 6.9
Sadharon Buddhimotta 6.1 3.1
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 8.0 7.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল