नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs DeepSeek: DeepSeek V3.2

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-15

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 medium रिलीज़: 2026-02-17 DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01
रैंक #12 #14
स्कोर 8.3 8.1
संगति 9.5 8.5
प्रति परिणाम लागत 8.525 0.225
कुल लागत $1.023 $0.025
सही परीक्षण
प्रति प्रयास पास दर 77.1% 79.2%
अस्थिर टेस्ट 1 3
कुल रन 48 48
आउटपुट टोकन 35,159 7,392
रीजनिंग टोकन 24,687 39,089
प्रतिक्रिया समय (औसत) 11.23s 39.48s
प्रतिक्रिया समय (अधिकतम) 46.35s 93.11s
प्रतिक्रिया समय (कुल) 89.84s 631.71s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 7.7 10.0 66.7% 0 4.95s 1,031 1,093
DeepSeek V3.2 7.8 9.9 66.7% 0 33.39s 1,171 4,893
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
DeepSeek V3.2 5.3 7.2 44.4% 1 39.32s 3,081 7,856
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859

त्वरित तुलना

तुलना जोड़ी बदलें