नेव्हिगेशन
AI BENCHY
Your ad here

AI BENCHY Compare

तुलना केलेली मॉडेल्स

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-05-01

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high प्रकाशन: 2026-04-24 DeepSeek V4 Flash DeepSeek V4 Flash high प्रकाशन: 2026-04-24 DeepSeek V3.2 DeepSeek V3.2 medium प्रकाशन: 2025-12-01
स्कोअर 7.0 7.8 8.0
क्रमांक #62 #43 #38
विश्वसनीयता 9.3 10.0 लागू नाही
सुसंगतता 8.0 7.8 8.2
बरोबर चाचण्या
प्रति प्रयत्न पास दर 73.2% 79.6% 79.6%
अस्थिर चाचण्या 4 5 4
एकूण रन 54 54 52
प्रति निकाल खर्च 1.896 0.277 0.231
एकूण खर्च $0.209 $0.031 $0.028
???? ??? $0.435 / 1M $0.140 / 1M $0.252 / 1M
????? ??? $0.870 / 1M $0.280 / 1M $0.378 / 1M
आउटपुट टोकन्स 12,158 1,765 7,554
रिझनिंग टोकन्स 49,967 90,299 45,588
प्रतिसाद वेळ (सरासरी) 60.03s 45.41s 43.49s
प्रतिसाद वेळ (कमाल) 358.35s 218.13s 180.92s
प्रतिसाद वेळ (एकूण) 1080.60s 817.30s 782.73s

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

अँटी-एआय युक्त्या स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 7.4 10.0 75.0% 0 16.53s 71 3,617
DeepSeek V4 Flash 8.3 10.0 75.0% 0 28.51s 140 7,770
DeepSeek V3.2 8.4 9.9 75.0% 0 30.72s 3,773 7,523
कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 2.6 0.0 50.0% 1 51.77s 105 2,641
DeepSeek V4 Flash 10.0 10.0 100.0% 0 62.48s 369 9,361
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
संयुक्त स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 465 5,914
DeepSeek V4 Flash 10.0 10.0 100.0% 0 76.57s 465 7,347
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
डेटा पार्सिंग आणि निष्कर्षण स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 8.8 10.0 100.0% 0 23.62s 229 1,710
DeepSeek V4 Flash 10.0 10.0 100.0% 0 28.03s 201 1,179
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
डोमेन-विशिष्ट स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 3.0 6.9 16.7% 1 205.66s 10,529 28,089
DeepSeek V4 Flash 4.1 4.4 44.5% 2 100.31s 27 59,249
DeepSeek V3.2 5.3 7.2 44.4% 1 21.78s 15 4,933
Samanya Buddhimatta स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 76 1,152
DeepSeek V4 Flash 6.1 3.1 66.7% 1 25.15s 79 632
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
सूचनांचे पालन स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 205 2,416
DeepSeek V4 Flash 10.0 10.0 100.0% 0 15.36s 63 1,622
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
कोडी सोडवणे स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 6.9 7.0 83.3% 1 34.92s 106 3,835
DeepSeek V4 Flash 6.4 4.5 77.8% 2 25.53s 193 2,597
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
टूल कॉलिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 372 593
DeepSeek V4 Flash 10.0 10.0 100.0% 0 74.73s 228 542
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859

झटपट तुलना

तुलना जोडी बदला