नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Pro vs Meituan: LongCat 2.0

DeepSeek V4 Pro (high) average score मध्ये पुढे आहे: 7.7 vs 7.4. DeepSeek V4 Pro (high) चा benchmark खर्च कमी आहे: $0.200 vs $0.478. DeepSeek V4 Pro (high) वेगवान आहे: 79.14s vs 136.64s, pass rates 63.6% vs 60.6%.

शिफारस केलेले मॉडेलDeepSeek V4 Pro (high)It has the best score here (7.7), while costing about 2.4x less than LongCat 2.0 (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro high प्रकाशन: 2026-04-24 LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20
स्कोअर 7.7 7.4
क्रमांक #50 #64
विश्वसनीयता 10.0 9.8
सुसंगतता 7.7 8.9
बरोबर चाचण्या
प्रति प्रयत्न पास दर 63.6% 60.6%
अस्थिर चाचण्या 6 3
एकूण रन 66 66
प्रति निकाल खर्च 2.000 3.978
एकूण खर्च $0.200 $0.478
इनपुट किंमत $0.435 / 1M $0.300 / 1M
आउटपुट किंमत $0.870 / 1M $1.200 / 1M
एकूण इनपुट टोकन्स 90,748 97,315
आउटपुट टोकन्स 10,462 44,384
रिझनिंग टोकन्स 178,719 329,012
प्रतिसाद वेळ (सरासरी) 79.14s 136.64s
प्रतिसाद वेळ (कमाल) 416.76s 939.52s
प्रतिसाद वेळ (एकूण) 1740.97s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 DeepSeek V4 Pro

high
खर्च
$0.023
वेळ
257.6s
टोकन्स
14,870 tok

#64 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

झटपट तुलना

तुलना जोडी बदला