নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Flash vs Z.ai: GLM 5

GLM 5 (medium) average score-এ এগিয়ে: 7.7 vs 7.7. DeepSeek V4 Flash (high)-এর benchmark খরচ কম: $0.041 vs $0.307. GLM 5 (medium) দ্রুত: 33.54s vs 49.75s, pass rates 72.7% vs 78.8%.

প্রস্তাবিত মডেলDeepSeek V4 Flash (high)Its score stays close to the best score here (7.7 vs 7.7), while costing about 7.7x less than GLM 5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

মেট্রিক DeepSeek V4 Flash DeepSeek V4 Flash high প্রকাশ: 2026-04-24 GLM 5 GLM 5 medium প্রকাশ: 2026-02-12
স্কোর 7.7 7.7
র‍্যাঙ্ক #52 #49
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.2 8.1
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.7% 78.8%
অস্থির টেস্ট 5 4
মোট রান 66 63
প্রতি ফলাফলে খরচ 0.402 1.668
মোট খরচ $0.041 $0.307
ইনপুট মূল্য $0.094 / 1M $0.950 / 1M
আউটপুট মূল্য $0.188 / 1M $2.551 / 1M
মোট ইনপুট টোকেন 108,392 35,224
আউটপুট টোকেন 14,478 21,570
রিজনিং টোকেন 153,687 102,996
প্রতিক্রিয়া সময় (গড়) 49.75s 33.54s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 218.13s 99.85s
প্রতিক্রিয়া সময় (মোট) 1094.41s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#52 DeepSeek V4 Flash

high
খরচ
$0.003
সময়
93.1s
টোকেন
7,926 tok

#49 GLM 5

medium
খরচ
$0.005
সময়
20.7s
টোকেন
2,068 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

দ্রুত তুলনা

তুলনার জুটি বদলান