नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs DeepSeek: DeepSeek V4 Pro

DeepSeek V4 Pro (high) average score में आगे है: 7.7 vs 7.5. DeepSeek V4 Pro (high) की benchmark लागत कम है: $0.200 vs $1.550. Claude Opus 5 तेज है: 7.60s vs 79.14s, pass rates 57.6% vs 63.6%.

अनुशंसित मॉडलDeepSeek V4 Pro (high)It has the best score here (7.7), while costing about 7.7x less than Claude Opus 5.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24
स्कोर 7.5 7.7
रैंक #59 #53
विश्वसनीयता 10.0 10.0
संगति 9.6 7.7
सही परीक्षण
प्रति प्रयास पास दर 57.6% 63.6%
अस्थिर टेस्ट 1 6
कुल रन 66 66
प्रति परिणाम लागत 12.912 2.000
कुल लागत $1.550 $0.200
इनपुट कीमत $5.000 / 1M $0.435 / 1M
आउटपुट कीमत $25.000 / 1M $0.870 / 1M
कुल इनपुट टोकन 185,550 90,748
आउटपुट टोकन 24,866 10,462
रीजनिंग टोकन 0 178,719
प्रतिक्रिया समय (औसत) 7.60s 79.14s
प्रतिक्रिया समय (अधिकतम) 47.72s 416.76s
प्रतिक्रिया समय (कुल) 167.28s 1740.97s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#53 DeepSeek V4 Pro

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580

त्वरित तुलना

तुलना जोड़ी बदलें