নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Small 4 (medium) vs Qwen3.5-9B

average score প্রায় সমান: 5.1 vs 5.1. Qwen3.5-9B-এর benchmark খরচ কম: $0.021 vs $0.096. Mistral Small 4 (medium) দ্রুত: 10.77s vs 19.17s, pass rates 42.4% vs 19.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#187
মোট আউটপুট টোকেন
131,824
প্রতিক্রিয়া সময় (গড়)
10.77s
মোট খরচ
$0.096
র‍্যাঙ্ক
#189
মোট আউটপুট টোকেন
37,484
প্রতিক্রিয়া সময় (গড়)
19.17s
মোট খরচ
$0.021
প্রস্তাবিত মডেল Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 1.8x faster than Qwen3.5-9B.

বিস্তারিত তুলনা

মেট্রিক Mistral Small 4 Mistral Small 4 medium প্রকাশ: 2026-03-16 Qwen3.5-9B Qwen3.5-9B none প্রকাশ: 2026-03-02
স্কোর 5.1 5.1
র‍্যাঙ্ক #187 #189
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 9.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 42.4% 19.7%
অস্থির টেস্ট 8 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.913 0.490
মোট খরচ $0.096 $0.021
ইনপুট মূল্য $0.150 / 1M $0.100 / 1M
আউটপুট মূল্য $0.600 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 140,494 144,407
আউটপুট টোকেন 39,462 37,484
রিজনিং টোকেন 92,362 0
প্রতিক্রিয়া সময় (গড়) 10.77s 19.17s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 59.15s 382.06s
প্রতিক্রিয়া সময় (মোট) 236.94s 421.74s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
খরচ
$0.006
সময়
47.9s
টোকেন
9,857 tok

#189 Qwen3.5-9B

none
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

দ্রুত তুলনা

তুলনার জুটি বদলান