नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Pro vs Z.ai: GLM 5.1

सारांश

DeepSeek V4 Pro vs GLM 5.1 benchmark तुलना: DeepSeek V4 Pro average score में आगे है: 6.0 vs 5.7. GLM 5.1 की benchmark लागत कम है: $0.058 vs $0.079. GLM 5.1 तेज है: 4.10s vs 65.21s, pass rates 52.4% vs 41.3%.

अनुशंसित मॉडल: GLM 5.1 - Its score stays close to the best score here (5.7 vs 6.0), while responding about 15.9x faster than DeepSeek V4 Pro.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-04

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24 GLM 5.1 GLM 5.1 none रिलीज़: 2026-04-07
स्कोर 6.0 5.7
रैंक #103 #112
विश्वसनीयता 9.0 10.0
संगति 7.6 8.5
सही परीक्षण
प्रति प्रयास पास दर 52.4% 41.3%
अस्थिर टेस्ट 6 4
कुल रन 63 63
प्रति परिणाम लागत 2.869 0.843
कुल लागत $0.079 $0.058
इनपुट कीमत $0.435 / 1M $0.980 / 1M
आउटपुट कीमत $0.870 / 1M $3.080 / 1M
कुल इनपुट टोकन 32,240 47,133
आउटपुट टोकन 12,250 3,754
रीजनिंग टोकन 72,257 0
प्रतिक्रिया समय (औसत) 65.21s 4.10s
प्रतिक्रिया समय (अधिकतम) 358.35s 32.57s
प्रतिक्रिया समय (कुल) 1304.19s 86.18s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#103 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#112 GLM 5.1

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.4 7.9 58.3% 1 16.53s 448 71 3,617
GLM 5.1 4.0 6.3 25.0% 2 2.11s 555 305 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.3 6.4 11.1% 1 118.23s 1,966 111 20,940
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 14,016 465 5,914
GLM 5.1 2.8 2.1 33.3% 1 32.57s 22,831 2,129 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 7.3 5.9 83.3% 1 23.62s 5,633 229 1,710
GLM 5.1 10.0 10.0 100.0% 0 1.08s 7,107 204 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 2.9 7.2 11.1% 1 205.66s 430 10,529 28,089
GLM 5.1 2.9 7.2 11.1% 1 1.99s 687 24 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 314 76 1,152
GLM 5.1 5.0 10.0 0.0% 0 790ms 477 39 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 627 205 2,416
GLM 5.1 9.8 10.0 100.0% 0 1.98s 636 66 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.9 7.2 55.6% 1 34.84s 544 139 4,019
GLM 5.1 7.7 10.0 66.7% 0 1.45s 609 151 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 8,079 372 593
GLM 5.1 10.0 10.0 100.0% 0 10.68s 6,789 300 0
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.0 10.0 0.0% 0 39.14s 183 53 3,807
GLM 5.1 3.0 10.0 0.0% 0 2.34s 186 11 0

त्वरित तुलना

तुलना जोड़ी बदलें