नेविगेशन
Advertise here

DeepSeek V3.2 (medium) vs LongCat 2.0

LongCat 2.0 average score में आगे है: 6.4 vs 6.3. LongCat 2.0 की benchmark लागत कम है: $0.104 vs $0.145. LongCat 2.0 तेज है: 8.50s vs 70.08s, pass rates 62.3% vs 42.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#221
कुल आउटपुट टोकन
143,160
प्रतिक्रिया समय (औसत)
70.08s
कुल लागत
$0.145
रैंक
#211
कुल आउटपुट टोकन
17,473
प्रतिक्रिया समय (औसत)
8.50s
कुल लागत
$0.104
अनुशंसित मॉडल LongCat 2.0

It has the best score here (6.4), while responding about 8.2x faster than DeepSeek V3.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20
स्कोर 6.3 6.4
रैंक #221 #211
विश्वसनीयता 10.0 10.0
संगति 7.5 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 62.3% 42.0%
अस्थिर टेस्ट 7 3
कुल रन 69 69
प्रति परिणाम लागत 1.250 1.298
कुल लागत $0.145 $0.104
इनपुट कीमत $0.280 / 1M $0.300 / 1M
आउटपुट कीमत $0.420 / 1M $1.200 / 1M
कुल इनपुट टोकन 306,662 276,199
आउटपुट टोकन 17,819 17,473
रीजनिंग टोकन 125,341 0
प्रतिक्रिया समय (औसत) 70.08s 8.50s
प्रतिक्रिया समय (अधिकतम) 376.10s 81.77s
प्रतिक्रिया समय (कुल) 1611.86s 195.60s
पैरामीटर 671B कुल (37B सक्रिय) 1.6T कुल (48B सक्रिय)
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#221 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#211 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0

त्वरित तुलना

तुलना जोड़ी बदलें