নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Pro vs Inception: Mercury 2

Mercury 2 (medium) average score-এ এগিয়ে: 7.0 vs 6.9. Mercury 2 (medium)-এর benchmark খরচ কম: $0.093 vs $0.096. Mercury 2 (medium) দ্রুত: 2.72s vs 11.55s, pass rates 51.5% vs 51.5%.

প্রস্তাবিত মডেলMercury 2 (medium)It has the best score here (7.0), while responding about 4.2x faster than DeepSeek V4 Pro.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক DeepSeek V4 Pro DeepSeek V4 Pro none প্রকাশ: 2026-04-24 Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24
স্কোর 6.9 7.0
র‍্যাঙ্ক #86 #82
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 8.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 51.5% 51.5%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.954 0.928
মোট খরচ $0.096 $0.093
ইনপুট মূল্য $0.435 / 1M $0.250 / 1M
আউটপুট মূল্য $0.870 / 1M $0.750 / 1M
মোট ইনপুট টোকেন 148,069 109,572
আউটপুট টোকেন 35,551 10,313
রিজনিং টোকেন 0 76,806
প্রতিক্রিয়া সময় (গড়) 11.55s 2.72s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 119.44s 14.63s
প্রতিক্রিয়া সময় (মোট) 254.11s 57.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 DeepSeek V4 Pro

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

#82 Mercury 2

medium
খরচ
$0.002
সময়
2.1s
টোকেন
1,702 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

দ্রুত তুলনা

তুলনার জুটি বদলান