AI BENCHY
Advertise here

#47

DeepSeek V4 Pro

DeepSeek প্রকাশ: 2026-04-24 পরীক্ষিত হয়েছে: 2026-04-26 10:50 deepseek/deepseek-v4-pro::high
(high) (none)

ধারাবাহিকতা

8.0

মোট আউটপুট টোকেন

57,875

ইনপুট মূল্য

$1.740 / 1M

আউটপুট মূল্য

$3.480 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 7

প্রতি চেষ্টায় পাস রেট: 73.2%

অস্থির টেস্ট

4

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

60.02s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 358.35s

প্রতিক্রিয়া সময় (মোট): 1080.31s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-22 00:54 স্যুইট পরিবর্তিত হয়েছে 6.6 9.0 $0.212 তুলনা করুন
2026-04-29 14:47 পুনরায় পরীক্ষা 7.5 9.3 $0.209 তুলনা করুন
2026-04-26 10:50 পুনরায় পরীক্ষা 7.5 8.4 $0.201 বর্তমান রান
2026-04-25 21:53 প্রথম রান 8.2 প্রযোজ্য নয় $0.329 তুলনা করুন

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-26 10:50 · পুনরায় পরীক্ষা7.58.08.411/18457,875$0.20160.02s
2026-04-29 14:47 · পুনরায় পরীক্ষা7.58.09.311/18462,125$0.20960.03s
পার্থক্য0.00.0-0.900-4250-$0.008-17ms

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 8.3 10.0
কোডিং 3.0 0.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 3.2 6.9
Sadharon Buddhimotta 6.1 3.1
নির্দেশনা অনুসরণ 10.0 10.0
ধাঁধা সমাধান 8.0 7.0
টুল কলিং 10.0 10.0

তুলনা করা মডেল