नेविगेशन
AI BENCHY
Advertise here

DeepSeek V4 Pro vs GLM 5.3 (low)

average score लगभग बराबर है: 6.8 vs 6.8. GLM 5.3 (low) की benchmark लागत कम है: $0.257 vs $0.351. DeepSeek V4 Pro तेज है: 11.71s vs 13.65s, pass rates 47.0% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#133
कुल आउटपुट टोकन
35,547
प्रतिक्रिया समय (औसत)
11.71s
कुल लागत
$0.351
रैंक
#134
कुल आउटपुट टोकन
24,808
प्रतिक्रिया समय (औसत)
13.65s
कुल लागत
$0.257
अनुशंसित मॉडल GLM 5.3 (low)

It has the strongest score in this comparison (6.8) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro none रिलीज़: 2026-04-24 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.8 6.8
रैंक #133 #134
विश्वसनीयता 10.0 10.0
संगति 8.6 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 47.0% 65.2%
अस्थिर टेस्ट 4 4
कुल रन 66 66
प्रति परिणाम लागत 1.061 2.135
कुल लागत $0.351 $0.257
इनपुट कीमत $1.600 / 1M $1.400 / 1M
आउटपुट कीमत $3.200 / 1M $4.400 / 1M
कुल इनपुट टोकन 148,078 104,989
आउटपुट टोकन 35,547 8,532
रीजनिंग टोकन 0 16,276
प्रतिक्रिया समय (औसत) 11.71s 13.65s
प्रतिक्रिया समय (अधिकतम) 119.44s 83.60s
प्रतिक्रिया समय (कुल) 257.67s 300.22s
पैरामीटर 1.6T कुल (49B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#133 DeepSeek V4 Pro

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#134 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें