নেভিগেশন
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs Qwen3.7 Plus

Qwen3.7 Plus average score-এ এগিয়ে: 7.2 vs 7.0. DeepSeek V3.2 (medium)-এর benchmark খরচ কম: $0.078 vs $0.106. Qwen3.7 Plus দ্রুত: 12.09s vs 68.62s, pass rates 65.2% vs 50.0%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#86
মোট আউটপুট টোকেন
128,848
প্রতিক্রিয়া সময় (গড়)
68.62s
মোট খরচ
$0.078
র‍্যাঙ্ক
#81
মোট আউটপুট টোকেন
58,097
প্রতিক্রিয়া সময় (গড়)
12.09s
মোট খরচ
$0.106
প্রস্তাবিত মডেল Qwen3.7 Plus

It has the best score here (7.2), while responding about 5.7x faster than DeepSeek V3.2 (medium).

বিস্তারিত তুলনা

মেট্রিক DeepSeek V3.2 DeepSeek V3.2 medium প্রকাশ: 2025-12-01 Qwen3.7 Plus Qwen3.7 Plus none প্রকাশ: 2026-06-03
স্কোর 7.0 7.2
র‍্যাঙ্ক #86 #81
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.4 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 50.0%
অস্থির টেস্ট 7 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.671 1.014
মোট খরচ $0.078 $0.106
ইনপুট মূল্য $0.269 / 1M $0.320 / 1M
আউটপুট মূল্য $0.400 / 1M $1.280 / 1M
মোট ইনপুট টোকেন 101,047 98,824
আউটপুট টোকেন 11,834 58,097
রিজনিং টোকেন 117,014 0
প্রতিক্রিয়া সময় (গড়) 68.62s 12.09s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 376.10s 206.03s
প্রতিক্রিয়া সময় (মোট) 1509.53s 265.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 DeepSeek V3.2

medium
খরচ
$0.001
সময়
53.6s
টোকেন
1,932 tok

#81 Qwen3.7 Plus

none
খরচ
$0.019
সময়
213.5s
টোকেন
11,960 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

দ্রুত তুলনা

তুলনার জুটি বদলান