नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Mistral: Mistral Small 4 vs Qwen: Qwen3.6 Flash

सारांश

Mistral Small 4 vs Qwen3.6 Flash benchmark तुलना: Qwen3.6 Flash average score में आगे है: 5.4 vs 5.3. Qwen3.6 Flash की benchmark लागत कम है: $0.015 vs $0.068. Qwen3.6 Flash तेज है: 1.60s vs 9.40s, pass rates 44.4% vs 33.3%.

अनुशंसित मॉडल: Qwen3.6 Flash - It has the best score here (5.4), while costing about 4.7x less than Mistral Small 4.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-10

मेट्रिक Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16 Qwen3.6 Flash Qwen3.6 Flash none रिलीज़: 2026-04-20
स्कोर 5.3 5.4
रैंक #133 #129
विश्वसनीयता 10.0 10.0
संगति 6.9 10.0
सही परीक्षण
प्रति प्रयास पास दर 44.4% 33.3%
अस्थिर टेस्ट 8 0
कुल रन 63 63
प्रति परिणाम लागत 1.344 0.266
कुल लागत $0.068 $0.015
इनपुट कीमत $0.150 / 1M $0.188 / 1M
आउटपुट कीमत $0.600 / 1M $1.125 / 1M
कुल इनपुट टोकन 42,576 50,810
आउटपुट टोकन 24,184 4,164
रीजनिंग टोकन 84,678 0
प्रतिक्रिया समय (औसत) 9.40s 1.60s
प्रतिक्रिया समय (अधिकतम) 59.15s 4.60s
प्रतिक्रिया समय (कुल) 197.39s 33.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 Mistral Small 4

medium
Cost
$0.006
Time
47.9s
Tokens
9,857 tok

#129 Qwen3.6 Flash

none
Cost
$0.005
Time
20.1s
Tokens
4,211 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 708 4,055 4,778
Qwen3.6 Flash 3.1 10.0 0.0% 0 1.63s 696 1,554 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.6 Flash 5.4 10.0 33.3% 0 1.79s 6,488 889 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 18,706 2,612 10,700
Qwen3.6 Flash 3.0 10.0 0.0% 0 4.22s 24,675 315 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 6,171 335 723
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.13s 7,794 243 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 742 2,621 6,904
Qwen3.6 Flash 5.3 10.0 33.3% 0 1.11s 789 15 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 519 821 828
Qwen3.6 Flash 10.0 10.0 100.0% 0 947ms 522 132 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 729 540 1,031
Qwen3.6 Flash 6.3 10.0 50.0% 0 1.10s 711 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.4 9.7 0.0% 0 2.17s 735 1,226 2,632
Qwen3.6 Flash 3.5 10.0 0.0% 0 1.21s 714 669 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 6,420 321 810
Qwen3.6 Flash 10.0 10.0 100.0% 0 2.49s 8,211 272 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 3.0 10.0 0.0% 0 5.92s 210 18 1,557
Qwen3.6 Flash 3.0 10.0 0.0% 0 649ms 210 9 0

त्वरित तुलना

तुलना जोड़ी बदलें