नेविगेशन
AI BENCHY
Advertise here

Mistral Small 4 (medium) vs Qwen3.5-9B

average score लगभग बराबर है: 5.1 vs 5.1. Qwen3.5-9B की benchmark लागत कम है: $0.021 vs $0.096. Mistral Small 4 (medium) तेज है: 10.77s vs 19.17s, pass rates 42.4% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#187
कुल आउटपुट टोकन
131,824
प्रतिक्रिया समय (औसत)
10.77s
कुल लागत
$0.096
रैंक
#189
कुल आउटपुट टोकन
37,484
प्रतिक्रिया समय (औसत)
19.17s
कुल लागत
$0.021
अनुशंसित मॉडल Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 1.8x faster than Qwen3.5-9B.

विस्तृत तुलना

मेट्रिक Mistral Small 4 Mistral Small 4 medium रिलीज़: 2026-03-16 Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 5.1 5.1
रैंक #187 #189
विश्वसनीयता 10.0 10.0
संगति 7.0 9.7
सही परीक्षण
प्रति प्रयास पास दर 42.4% 19.7%
अस्थिर टेस्ट 8 1
कुल रन 66 66
प्रति परिणाम लागत 1.913 0.490
कुल लागत $0.096 $0.021
इनपुट कीमत $0.150 / 1M $0.100 / 1M
आउटपुट कीमत $0.600 / 1M $0.150 / 1M
कुल इनपुट टोकन 140,494 144,407
आउटपुट टोकन 39,462 37,484
रीजनिंग टोकन 92,362 0
प्रतिक्रिया समय (औसत) 10.77s 19.17s
प्रतिक्रिया समय (अधिकतम) 59.15s 382.06s
प्रतिक्रिया समय (कुल) 236.94s 421.74s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#187 Mistral Small 4

medium
लागत
$0.006
समय
47.9s
टोकन
9,857 tok

#189 Qwen3.5-9B

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें