নেভিগেশন
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 (high) vs GLM 5.1 (medium)

average score প্রায় সমান: 7.5 vs 7.5. Mistral Large 4 (high)-এর benchmark খরচ কম: $1.391 vs $1.546. GLM 5.1 (medium) দ্রুত: 66.38s vs 263.69s, pass rates 65.2% vs 66.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-06

তুলনা করা মডেল

র‍্যাঙ্ক
#126
মোট আউটপুট টোকেন
590,306
প্রতিক্রিয়া সময় (গড়)
263.69s
মোট খরচ
$1.391
র‍্যাঙ্ক
#124
মোট আউটপুট টোকেন
245,833
প্রতিক্রিয়া সময় (গড়)
66.38s
মোট খরচ
$1.546
প্রস্তাবিত মডেল GLM 5.1 (medium)

It has the best score here (7.5), while responding about 4.0x faster than Mistral Large 4 (high).

বিস্তারিত তুলনা

মেট্রিক Mistral Large 4 Mistral Large 4 high প্রকাশ: 2026-10-06 GLM 5.1 GLM 5.1 medium প্রকাশ: 2026-04-07
স্কোর 7.5 7.5
র‍্যাঙ্ক #126 #124
নির্ভরযোগ্যতা 9.0 9.2
ধারাবাহিকতা 7.9 8.4
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 66.7%
অস্থির টেস্ট 6 4
মোট রান 69 69
প্রতি ফলাফলে খরচ 11.590 9.004
মোট খরচ $1.391 $1.546
ইনপুট মূল্য $0.680 / 1M $1.400 / 1M
আউটপুট মূল্য $2.090 / 1M $4.400 / 1M
ক্যাশ পড়ার মূল্য $0.070 / 1M $0.260 / 1M
ক্যাশ লেখার মূল্য প্রযোজ্য নয় প্রযোজ্য নয়
মোট ইনপুট টোকেন 230,895 331,577
আউটপুট টোকেন 161,281 17,919
রিজনিং টোকেন 510,655 230,789
প্রতিক্রিয়া সময় (গড়) 263.69s 66.38s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1727.29s 308.75s
প্রতিক্রিয়া সময় (মোট) 6064.89s 1460.31s
প্যারামিটার 1.05T মোট (49B সক্রিয়) 744B মোট (40B সক্রিয়)
উপলভ্যতা বন্ধ উৎস উন্মুক্ত উৎস

ক্যাশের মূল্য ইনপুট টোকেনের জন্য প্রযোজ্য। পড়ার সময় ক্যাশ করা প্রম্পট আবার ব্যবহার হয়; লেখার সময় সেগুলি সংরক্ষিত হয় এবং বাড়তি খরচ হতে পারে। আউটপুট টোকেনের জন্য আউটপুট মূল্য প্রযোজ্য।

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 Mistral Large 4

high
খরচ
$0.007
সময়
53.3s
টোকেন
3,333 tok

#124 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Large 4 3.3 4.4 33.3% 2 1277.83s 6,541 53,820 279,694
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

দ্রুত তুলনা

তুলনার জুটি বদলান

Space Bunny AlphahighvsGLM 5.1mediumSeed-2.0-MinimediumvsMistral Large 4highQwen3.8 27Blowবিনামূল্যে উপলভ্যvsGLM 5.1mediumGPT-6 LunalowvsGLM 5.1mediumMistral Large 4lowvsGLM 5.1mediumMistral Large 4highvsQwen3.8 27Blowবিনামূল্যে উপলভ্যMistral Large 4highvsGPT-6 LunalowMistral Large 4highvsQwen3.8 Flash NextmediumSeed-2.0-CodehighvsGLM 5.1mediumMistral Large 4highvsGPT-5.6 LunamediumMistral Large 4highvsQwen3.6 FlashmediumDeepSeek V4 Flash 0731lowvsMistral Large 4high