AI BENCHY
Advertise here

#112

DeepSeek V4 Pro

DeepSeek প্রকাশ: 2026-04-24 পরীক্ষিত হয়েছে: 2026-04-24 09:19 deepseek/deepseek-v4-pro::none
(high) (none)

ধারাবাহিকতা

7.2

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

591

ইনপুট মূল্য

$1.740 / 1M

আউটপুট মূল্য

$3.480 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 18

প্রতি চেষ্টায় পাস রেট: 11.1%

অস্থির টেস্ট

6

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

44.40s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 125.71s

প্রতিক্রিয়া সময় (মোট): 577.18s

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-22 00:38 স্যুইট পরিবর্তিত হয়েছে 6.0 8.1 $0.046 তুলনা করুন
2026-04-29 14:46 পুনরায় পরীক্ষা 6.2 7.9 $0.043 তুলনা করুন
2026-04-24 09:19 প্রথম রান 3.1 প্রযোজ্য নয় $0.009 বর্তমান রান

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-24 09:19 · প্রথম রান3.17.2প্রযোজ্য নয়0/186591$0.00944.40s
2026-04-29 14:46 · পুনরায় পরীক্ষা6.28.77.97/1833,903$0.04314.01s
পার্থক্য-3.1-1.5-7+3-3312-$0.034+30391ms

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 3.1 10.0
কোডিং 2.8 1.6
সমন্বিত 3.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 2.8 1.6
ডোমেইন-নির্দিষ্ট 3.0 10.0
Sadharon Buddhimotta 3.4 9.6
নির্দেশনা অনুসরণ 3.3 6.1
ধাঁধা সমাধান 3.6 4.3
টুল কলিং 3.0 10.0

তুলনা করা মডেল