नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Pro vs xAI: Grok 4.20

सारांश

DeepSeek V4 Pro vs Grok 4.20 benchmark तुलना: Grok 4.20 average score में आगे है: 7.3 vs 7.2. DeepSeek V4 Pro की benchmark लागत कम है: $0.034 vs $0.609. DeepSeek V4 Pro तेज है: 6.41s vs 27.68s, pass rates 52.4% vs 63.5%.

अनुशंसित मॉडल: DeepSeek V4 Pro - Its score stays close to the best score here (7.2 vs 7.3), while costing about 18.3x less than Grok 4.20.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro none रिलीज़: 2026-04-24 Grok 4.20 Grok 4.20 medium रिलीज़: 2026-03-31
स्कोर 7.2 7.3
रैंक #58 #53
विश्वसनीयता 9.9 10.0
संगति 8.8 8.8
सही परीक्षण
प्रति प्रयास पास दर 52.4% 63.5%
अस्थिर टेस्ट 3 3
कुल रन 63 63
प्रति परिणाम लागत 0.333 8.309
कुल लागत $0.034 $0.609
इनपुट कीमत $0.435 / 1M $1.250 / 1M
आउटपुट कीमत $0.870 / 1M $2.500 / 1M
कुल इनपुट टोकन 53,558 44,433
आउटपुट टोकन 11,424 1,819
रीजनिंग टोकन 0 219,524
प्रतिक्रिया समय (औसत) 6.41s 27.68s
प्रतिक्रिया समय (अधिकतम) 30.09s 199.66s
प्रतिक्रिया समय (कुल) 134.66s 581.26s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 DeepSeek V4 Pro

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#53 xAI: Grok 4.20

medium
लागत
$0.041
समय
110.3s
टोकन
16,336 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.2 6.1 16.7% 2 4.02s 540 1,168 0
Grok 4.20 8.2 7.9 83.3% 1 3.95s 2,010 287 8,312
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 9.5 10.0 100.0% 0 23.74s 27,529 2,235 0
Grok 4.20 10.0 10.0 100.0% 0 17.40s 12,909 232 9,556
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 4.61s 7,568 200 0
Grok 4.20 10.0 10.0 100.0% 0 4.17s 7,761 180 5,333
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.72s 666 24 0
Grok 4.20 5.3 10.0 33.3% 0 27.03s 1,764 375 49,339
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.0 10.0 0.0% 0 2.05s 471 126 0
Grok 4.20 3.9 2.6 33.3% 1 24.48s 825 65 6,440
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.3 5.8 66.7% 1 4.12s 627 713 0
Grok 4.20 9.8 10.0 100.0% 0 4.26s 1,362 57 6,419
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 3.61s 594 442 0
Grok 4.20 7.7 10.0 66.7% 0 6.22s 1,689 149 7,913
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 7.40s 8,105 328 0
Grok 4.20 3.0 10.0 0.0% 0 13.68s 7,275 197 6,620
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 3.0 10.0 0.0% 0 5.76s 183 688 0
Grok 4.20 3.0 10.0 0.0% 0 63.48s 531 9 16,442

त्वरित तुलना

तुलना जोड़ी बदलें