नेव्हिगेशन
AI BENCHY
Advertise here

AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs DeepSeek: DeepSeek V4 Flash

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-28

मेट्रिक Claude Opus 4.8 Claude Opus 4.8 medium प्रकाशन: 2026-05-28 DeepSeek V4 Flash DeepSeek V4 Flash high प्रकाशन: 2026-04-24 मोफत उपलब्ध
स्कोअर 8.7 7.6
क्रमांक #12 #45
विश्वसनीयता 10.0 10.0
सुसंगतता 9.6 8.4
बरोबर चाचण्या
प्रति प्रयत्न पास दर 83.3% 73.3%
अस्थिर चाचण्या 1 4
एकूण रन 60 60
प्रति निकाल खर्च 6.285 0.309
एकूण खर्च $1.006 $0.028
इनपुट किंमत $5.000 / 1M $0.100 / 1M
आउटपुट किंमत $25.000 / 1M $0.200 / 1M
आउटपुट टोकन्स 23,201 10,302
रिझनिंग टोकन्स 5,901 115,740
प्रतिसाद वेळ (सरासरी) 9.34s 46.36s
प्रतिसाद वेळ (कमाल) 38.03s 218.13s
प्रतिसाद वेळ (एकूण) 186.84s 927.27s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 1,179 478
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 14.97s 6,651 1,381
DeepSeek V4 Flash 6.8 10.0 50.0% 0 58.13s 387 27,101
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 9.8 10.0 100.0% 0 38.03s 5,260 1,588
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 7.1 5.6 83.3% 1 12.29s 481 312
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 5.3 10.0 33.3% 0 14.15s 7,477 900
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 27 59,249
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 2.46s 237 0
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.32s 373 320
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 3.95s 791 483
DeepSeek V4 Flash 8.2 7.2 88.9% 1 26.11s 196 1,767
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 10.0 10.0 100.0% 0 8.96s 301 225
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542
सामान्य ज्ञान स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
Claude Opus 4.8 3.0 10.0 0.0% 0 6.14s 451 214
DeepSeek V4 Flash 3.0 10.0 0.0% 0 54.46s 8,516 8,531

झटपट तुलना

तुलना जोडी बदला