नेविगेशन
Advertise here

DeepSeek V3.2 vs Qwen3.5-9B

Qwen3.5-9B average score में आगे है: 5.1 vs 5.0. Qwen3.5-9B की benchmark लागत कम है: $0.021 vs $0.054. DeepSeek V3.2 तेज है: 17.89s vs 19.19s, pass rates 36.4% vs 19.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-08

तुलना किए गए मॉडल

रैंक
#273
कुल आउटपुट टोकन
42,099
प्रतिक्रिया समय (औसत)
17.89s
कुल लागत
$0.054
रैंक
#267
कुल आउटपुट टोकन
37,484
प्रतिक्रिया समय (औसत)
19.19s
कुल लागत
$0.021
अनुशंसित मॉडल Qwen3.5-9B

It has the best score here (5.1), while costing about 2.7x less than DeepSeek V3.2.

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 5.0 5.1
रैंक #273 #267
विश्वसनीयता 10.0 10.0
संगति 8.1 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 36.4% 19.7%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 0.870 0.490
कुल लागत $0.054 $0.021
इनपुट कीमत $0.269 / 1M $0.100 / 1M
आउटपुट कीमत $0.400 / 1M $0.150 / 1M
कुल इनपुट टोकन 135,831 144,416
आउटपुट टोकन 42,099 37,484
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 17.89s 19.19s
प्रतिक्रिया समय (अधिकतम) 115.89s 382.06s
प्रतिक्रिया समय (कुल) 393.53s 422.25s
पैरामीटर 671B कुल (37B सक्रिय) 9B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#273 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#267 Qwen3.5-9B

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें