नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Pro vs Meituan: LongCat 2.0

DeepSeek V4 Pro (high) average score में आगे है: 7.7 vs 7.4. DeepSeek V4 Pro (high) की benchmark लागत कम है: $0.200 vs $0.478. DeepSeek V4 Pro (high) तेज है: 79.14s vs 136.64s, pass rates 63.6% vs 60.6%.

अनुशंसित मॉडलDeepSeek V4 Pro (high)It has the best score here (7.7), while costing about 2.4x less than LongCat 2.0 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-21

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high रिलीज़: 2026-04-24 LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20
स्कोर 7.7 7.4
रैंक #50 #64
विश्वसनीयता 10.0 9.8
संगति 7.7 8.9
सही परीक्षण
प्रति प्रयास पास दर 63.6% 60.6%
अस्थिर टेस्ट 6 3
कुल रन 66 66
प्रति परिणाम लागत 2.000 3.978
कुल लागत $0.200 $0.478
इनपुट कीमत $0.435 / 1M $0.300 / 1M
आउटपुट कीमत $0.870 / 1M $1.200 / 1M
कुल इनपुट टोकन 90,748 97,315
आउटपुट टोकन 10,462 44,384
रीजनिंग टोकन 178,719 329,012
प्रतिक्रिया समय (औसत) 79.14s 136.64s
प्रतिक्रिया समय (अधिकतम) 416.76s 939.52s
प्रतिक्रिया समय (कुल) 1740.97s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 DeepSeek V4 Pro

high
लागत
$0.023
समय
257.6s
टोकन
14,870 tok

#64 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

त्वरित तुलना

तुलना जोड़ी बदलें