नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Opus 5 vs DeepSeek: DeepSeek V4 Pro

DeepSeek V4 Pro (high) average score मध्ये पुढे आहे: 7.7 vs 7.5. DeepSeek V4 Pro (high) चा benchmark खर्च कमी आहे: $0.200 vs $1.550. Claude Opus 5 वेगवान आहे: 7.60s vs 79.14s, pass rates 57.6% vs 63.6%.

शिफारस केलेले मॉडेलDeepSeek V4 Pro (high)It has the best score here (7.7), while costing about 7.7x less than Claude Opus 5.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-25

मेट्रिक Claude Opus 5 Claude Opus 5 none प्रकाशन: 2026-07-25 DeepSeek V4 Pro DeepSeek V4 Pro high प्रकाशन: 2026-04-24
स्कोअर 7.5 7.7
क्रमांक #59 #53
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 7.7
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 63.6%
अस्थिर चाचण्या 1 6
एकूण रन 66 66
प्रति निकाल खर्च 12.912 2.000
एकूण खर्च $1.550 $0.200
इनपुट किंमत $5.000 / 1M $0.435 / 1M
आउटपुट किंमत $25.000 / 1M $0.870 / 1M
एकूण इनपुट टोकन्स 185,550 90,748
आउटपुट टोकन्स 24,866 10,462
रिझनिंग टोकन्स 0 178,719
प्रतिसाद वेळ (सरासरी) 7.60s 79.14s
प्रतिसाद वेळ (कमाल) 47.72s 416.76s
प्रतिसाद वेळ (एकूण) 167.28s 1740.97s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#59 Claude Opus 5

none
खर्च
$0.271
वेळ
149.3s
टोकन्स
10,962 tok

#53 DeepSeek V4 Pro

high
खर्च
$0.023
वेळ
257.6s
टोकन्स
14,870 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580

झटपट तुलना

तुलना जोडी बदला