नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.5-9B

Qwen3.5-9B average score में आगे है: 5.1 vs 5.0. Qwen3.5-9B की benchmark लागत कम है: $0.021 vs $0.054. DeepSeek V3.2 तेज है: 18.25s vs 19.17s, pass rates 37.9% vs 19.7%.

अनुशंसित मॉडलQwen3.5-9BIt has the best score here (5.1), while costing about 2.7x less than DeepSeek V3.2.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 none रिलीज़: 2025-12-01 Qwen3.5-9B Qwen3.5-9B none रिलीज़: 2026-03-02
स्कोर 5.0 5.1
रैंक #188 #183
विश्वसनीयता 10.0 10.0
संगति 7.7 9.7
सही परीक्षण
प्रति प्रयास पास दर 37.9% 19.7%
अस्थिर टेस्ट 6 1
कुल रन 66 66
प्रति परिणाम लागत 0.870 0.490
कुल लागत $0.054 $0.021
इनपुट कीमत $0.269 / 1M $0.100 / 1M
आउटपुट कीमत $0.400 / 1M $0.150 / 1M
कुल इनपुट टोकन 135,780 144,407
आउटपुट टोकन 42,097 37,484
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 18.25s 19.17s
प्रतिक्रिया समय (अधिकतम) 115.89s 382.06s
प्रतिक्रिया समय (कुल) 401.60s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 DeepSeek V3.2

none
लागत
$0.002
समय
7.0s
टोकन
1,046 tok

#183 Qwen3.5-9B

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

त्वरित तुलना

तुलना जोड़ी बदलें