नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 vs Mistral Small 4 (medium)

Mistral Small 4 (medium) average score में आगे है: 5.1 vs 5.0. DeepSeek V3.2 की benchmark लागत कम है: $0.054 vs $0.097. Mistral Small 4 (medium) तेज है: 10.80s vs 17.89s, pass rates 36.4% vs 43.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#244
कुल आउटपुट टोकन
42,099
प्रतिक्रिया समय (औसत)
17.89s
कुल लागत
$0.054
रैंक
#236
कुल आउटपुट टोकन
133,597
प्रतिक्रिया समय (औसत)
10.80s
कुल लागत
$0.097
अनुशंसित मॉडल Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 1.7x faster than DeepSeek V3.2.

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16
स्कोर 5.0 5.1
रैंक #244 #236
विश्वसनीयता 10.0 10.0
संगति 8.1 7.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 43.9%
अस्थिर टेस्ट 5 8
कुल रन 66 66
प्रति परिणाम लागत 0.870 1.923
कुल लागत $0.054 $0.097
इनपुट कीमत $0.269 / 1M $0.150 / 1M
आउटपुट कीमत $0.400 / 1M $0.600 / 1M
कुल इनपुट टोकन 135,831 140,559
आउटपुट टोकन 42,099 40,268
रीजनिंग टोकन 0 93,329
प्रतिक्रिया समय (औसत) 17.89s 10.80s
प्रतिक्रिया समय (अधिकतम) 115.89s 59.15s
प्रतिक्रिया समय (कुल) 393.53s 237.60s
पैरामीटर 671B कुल (37B सक्रिय) 119B कुल (6B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#244 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#236 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715

त्वरित तुलना

तुलना जोड़ी बदलें