नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Inception: Mercury 2

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-04-24

मेट्रिक DeepSeek V4 Flash DeepSeek V4 Flash none प्रकाशन: 2026-04-24 Mercury 2 Mercury 2 medium प्रकाशन: 2026-02-24
स्कोअर 5.3 6.5
क्रमांक #89 #62
सुसंगतता 9.1 8.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 33.3% 53.7%
अस्थिर चाचण्या 2 3
एकूण रन 54 54
प्रति निकाल खर्च 0.147 0.580
एकूण खर्च $0.008 $0.047
???? ??? $0.140 / 1M $0.250 / 1M
????? ??? $0.280 / 1M $0.750 / 1M
आउटपुट टोकन्स 4,444 3,972
रिझनिंग टोकन्स 0 48,333
प्रतिसाद वेळ (सरासरी) 29.39s 2.21s
प्रतिसाद वेळ (कमाल) 111.96s 14.63s
प्रतिसाद वेळ (एकूण) 529.10s 37.51s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 3.0 10.0 0.0% 0 20.18s 174 0
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 6.3 10.0 0.0% 0 24.04s 471 0
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 4.5 2.1 66.7% 1 111.96s 2,664 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 10.0 10.0 100.0% 0 23.79s 195 0
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 5.3 10.0 33.3% 0 19.73s 18 0
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 4.2 9.9 0.0% 0 23.74s 67 0
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 6.5 10.0 50.0% 0 17.54s 321 0
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 3.1 7.3 11.1% 1 22.96s 207 0
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Flash 10.0 10.0 100.0% 0 77.93s 327 0
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956

झटपट तुलना

तुलना जोडी बदला