নেভিগেশন
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs GLM 5.2 (medium)

GLM 5.2 (medium) average score-এ এগিয়ে: 7.8 vs 7.7. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.176 vs $0.200. GLM 5.2 (medium) দ্রুত: 23.28s vs 79.14s, pass rates 63.6% vs 80.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-01

র‍্যাঙ্ক
#58
মোট আউটপুট টোকেন
189,181
প্রতিক্রিয়া সময় (গড়)
79.14s
মোট খরচ
$0.200
র‍্যাঙ্ক
#49
মোট আউটপুট টোকেন
61,761
প্রতিক্রিয়া সময় (গড়)
23.28s
মোট খরচ
$0.176
প্রস্তাবিত মডেল GLM 5.2 (medium)

It has the best score here (7.8), while responding about 3.4x faster than DeepSeek V4 Pro (high).

বিস্তারিত তুলনা

মেট্রিক DeepSeek V4 Pro DeepSeek V4 Pro high প্রকাশ: 2026-04-24 GLM 5.2 GLM 5.2 medium প্রকাশ: 2026-06-17
স্কোর 7.7 7.8
র‍্যাঙ্ক #58 #49
নির্ভরযোগ্যতা 10.0 9.5
ধারাবাহিকতা 7.7 8.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 80.3%
অস্থির টেস্ট 6 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 2.000 2.159
মোট খরচ $0.200 $0.176
ইনপুট মূল্য $0.435 / 1M $0.761 / 1M
আউটপুট মূল্য $0.870 / 1M $2.389 / 1M
মোট ইনপুট টোকেন 90,748 37,199
আউটপুট টোকেন 10,462 12,261
রিজনিং টোকেন 178,719 49,500
প্রতিক্রিয়া সময় (গড়) 79.14s 23.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 416.76s 101.36s
প্রতিক্রিয়া সময় (মোট) 1740.97s 488.94s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 DeepSeek V4 Pro

high
খরচ
$0.023
সময়
257.6s
টোকেন
14,870 tok

#49 GLM 5.2

medium
খরচ
$0.041
সময়
195.8s
টোকেন
9,287 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

দ্রুত তুলনা

তুলনার জুটি বদলান