नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. DeepSeek V3.2 (medium) की benchmark लागत कम है: $0.078 vs $0.948. GLM 5.1 (medium) तेज है: 58.80s vs 68.43s, pass rates 65.2% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#119
कुल आउटपुट टोकन
128,787
प्रतिक्रिया समय (औसत)
68.43s
कुल लागत
$0.078
रैंक
#120
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.948
अनुशंसित मॉडल DeepSeek V3.2 (medium)

It has the best score here (7.0), while costing about 12.3x less than GLM 5.1 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #119 #120
विश्वसनीयता 10.0 8.1
संगति 7.4 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 65.2%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 0.672 6.923
कुल लागत $0.078 $0.948
इनपुट कीमत $0.269 / 1M $1.260 / 1M
आउटपुट कीमत $0.400 / 1M $3.961 / 1M
कुल इनपुट टोकन 101,056 82,592
आउटपुट टोकन 11,832 16,089
रीजनिंग टोकन 116,955 199,800
प्रतिक्रिया समय (औसत) 68.43s 58.80s
प्रतिक्रिया समय (अधिकतम) 376.10s 308.75s
प्रतिक्रिया समय (कुल) 1505.53s 1234.72s
पैरामीटर 671B कुल (37B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#119 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#120 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें