नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.6 vs DeepSeek: DeepSeek V4 Pro

सारांश

Claude Opus 4.6 vs DeepSeek V4 Pro benchmark तुलना: Claude Opus 4.6 average score मध्ये पुढे आहे: 7.7 vs 7.2. DeepSeek V4 Pro चा benchmark खर्च कमी आहे: $0.034 vs $2.053. DeepSeek V4 Pro वेगवान आहे: 6.41s vs 25.89s, pass rates 61.9% vs 52.4%.

शिफारस केलेले मॉडेल: DeepSeek V4 Pro - Its score stays close to the best score here (7.2 vs 7.7), while costing about 61.7x less than Claude Opus 4.6.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-06-18

मेट्रिक Claude Opus 4.6 Claude Opus 4.6 medium प्रकाशन: 2026-02-05 DeepSeek V4 Pro DeepSeek V4 Pro none प्रकाशन: 2026-04-24
स्कोअर 7.7 7.2
क्रमांक #38 #58
विश्वसनीयता 10.0 9.9
सुसंगतता 8.8 8.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 61.9% 52.4%
अस्थिर चाचण्या 3 3
एकूण रन 63 63
प्रति निकाल खर्च 17.103 0.333
एकूण खर्च $2.053 $0.034
इनपुट किंमत $5.000 / 1M $0.435 / 1M
आउटपुट किंमत $25.000 / 1M $0.870 / 1M
एकूण इनपुट टोकन्स 53,227 53,558
आउटपुट टोकन्स 47,446 11,424
रिझनिंग टोकन्स 24,000 0
प्रतिसाद वेळ (सरासरी) 25.89s 6.41s
प्रतिसाद वेळ (कमाल) 83.40s 30.09s
प्रतिसाद वेळ (एकूण) 362.49s 134.66s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#38 Claude Opus 4.6

medium
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#58 DeepSeek V4 Pro

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 6.4 5.8 66.7% 2 7.45s 840 986 1,071
DeepSeek V4 Pro 3.2 6.1 16.7% 2 4.02s 540 1,168 0
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 5.7 7.1 44.4% 1 30.10s 8,522 13,057 4,121
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 76.66s 20,685 8,178 5,194
DeepSeek V4 Pro 9.5 10.0 100.0% 0 23.74s 27,529 2,235 0
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 7.37s 8,676 691 757
DeepSeek V4 Pro 10.0 10.0 100.0% 0 4.61s 7,568 200 0
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 3.0 10.0 0.0% 0 83.40s 674 14,642 8,687
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.72s 666 24 0
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 5.04s 564 188 292
DeepSeek V4 Pro 5.0 10.0 0.0% 0 2.05s 471 126 0
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 2.43s 792 266 467
DeepSeek V4 Pro 6.3 5.8 66.7% 1 4.12s 627 713 0
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 7.7 10.0 66.7% 0 4.71s 816 532 630
DeepSeek V4 Pro 10.0 10.0 100.0% 0 3.61s 594 442 0
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 10.0 10.0 100.0% 0 9.73s 11,454 861 329
DeepSeek V4 Pro 10.0 10.0 100.0% 0 7.40s 8,105 328 0
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.6 3.0 10.0 0.0% 0 63.24s 204 8,045 2,452
DeepSeek V4 Pro 3.0 10.0 0.0% 0 5.76s 183 688 0

झटपट तुलना

तुलना जोडी बदला