নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs Qwen: Qwen3.6 Flash

সারাংশ

Mistral Small 4 vs Qwen3.6 Flash benchmark তুলনা: Qwen3.6 Flash average score-এ এগিয়ে: 5.4 vs 5.3. Qwen3.6 Flash-এর benchmark খরচ কম: $0.015 vs $0.068. Qwen3.6 Flash দ্রুত: 1.60s vs 9.40s, pass rates 44.4% vs 33.3%.

প্রস্তাবিত মডেল: Qwen3.6 Flash - It has the best score here (5.4), while costing about 4.7x less than Mistral Small 4.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-10

মেট্রিক Mistral Small 4 Mistral Small 4 medium প্রকাশ: 2026-03-16 Qwen3.6 Flash Qwen3.6 Flash none প্রকাশ: 2026-04-20
স্কোর 5.3 5.4
র‍্যাঙ্ক #133 #129
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 6.9 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 44.4% 33.3%
অস্থির টেস্ট 8 0
মোট রান 63 63
প্রতি ফলাফলে খরচ 1.344 0.266
মোট খরচ $0.068 $0.015
ইনপুট মূল্য $0.150 / 1M $0.188 / 1M
আউটপুট মূল্য $0.600 / 1M $1.125 / 1M
মোট ইনপুট টোকেন 42,576 50,810
আউটপুট টোকেন 24,184 4,164
রিজনিং টোকেন 84,678 0
প্রতিক্রিয়া সময় (গড়) 9.40s 1.60s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 59.15s 4.60s
প্রতিক্রিয়া সময় (মোট) 197.39s 33.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#129 Qwen3.6 Flash

none
Cost
$0.005
Time
20.1s
Tokens
4,211 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Qwen3.6 Flash 3.1 10.0 0.0% 0 1.63s 696 1,554 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Qwen3.6 Flash 3.0 10.0 0.0% 0 4.22s 24,675 315 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.13s 7,794 243 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Qwen3.6 Flash 5.3 10.0 33.3% 0 1.11s 789 15 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Qwen3.6 Flash 10.0 10.0 100.0% 0 947ms 522 132 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Qwen3.6 Flash 6.3 10.0 50.0% 0 1.10s 711 66 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Qwen3.6 Flash 3.5 10.0 0.0% 0 1.21s 714 669 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.49s 8,211 272 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Qwen3.6 Flash 3.0 10.0 0.0% 0 649ms 210 9 0

দ্রুত তুলনা

তুলনার জুটি বদলান