নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.5-27B

সারাংশ

Mistral Small 4 vs Qwen3.5-27B benchmark তুলনা: Qwen3.5-27B average score-এ এগিয়ে: 5.9 vs 5.1. Mistral Small 4-এর benchmark খরচ কম: $0.007 vs $0.015. Mistral Small 4 দ্রুত: 630ms vs 1.68s, pass rates 27.0% vs 38.1%.

প্রস্তাবিত মডেল: Mistral Small 4 - Its score stays close to the best score here (5.1 vs 5.9), while costing about 2.1x less than Qwen3.5-27B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Mistral Small 4 Mistral Small 4 none প্রকাশ: 2026-03-16 Qwen3.5-27B Qwen3.5-27B none প্রকাশ: 2026-02-24
স্কোর 5.1 5.9
র‍্যাঙ্ক #136 #109
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.5 9.3
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 27.0% 38.1%
অস্থির টেস্ট 1 2
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.139 0.249
মোট খরচ $0.007 $0.015
ইনপুট মূল্য $0.150 / 1M $0.195 / 1M
আউটপুট মূল্য $0.600 / 1M $1.560 / 1M
মোট ইনপুট টোকেন 37,309 44,478
আউটপুট টোকেন 2,201 3,592
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 630ms 1.68s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1.72s 9.39s
প্রতিক্রিয়া সময় (মোট) 13.22s 35.25s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 Mistral Small 4

none
Cost
$0.002
Time
10.4s
Tokens
2,370 tok

#109 Qwen3.5-27B

none
Cost
$0.007
Time
42.9s
Tokens
4,273 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.4 7.9 16.7% 1 395ms 708 182 0
Qwen3.5-27B 4.8 10.0 25.0% 0 788ms 696 267 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 11,640 496 0
Qwen3.5-27B 2.8 1.6 33.3% 1 9.39s 16,918 1,461 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 10.0 10.0 100.0% 0 822ms 7,914 261 0
Qwen3.5-27B 10.0 10.0 100.0% 0 1.43s 7,794 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 5.3 10.0 33.3% 0 367ms 798 28 0
Qwen3.5-27B 3.0 10.0 0.0% 0 540ms 789 15 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.0 10.0 0.0% 0 729ms 519 205 0
Qwen3.5-27B 5.0 10.0 0.0% 0 2.51s 522 126 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 6.5 10.0 50.0% 0 380ms 729 69 0
Qwen3.5-27B 6.3 10.0 50.0% 0 1.03s 711 69 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.1 9.9 0.0% 0 399ms 735 111 0
Qwen3.5-27B 6.7 7.9 55.6% 1 1.38s 714 683 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 6,420 213 0
Qwen3.5-27B 10.0 10.0 100.0% 0 3.54s 8,211 303 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.0 10.0 0.0% 0 397ms 210 17 0
Qwen3.5-27B 3.0 10.0 0.0% 0 599ms 210 10 0

দ্রুত তুলনা

তুলনার জুটি বদলান