नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (medium) vs Qwen3.5 Plus 2026-02-15 (medium)

average score लगभग बराबर है: 7.2 vs 7.2. Qwen3.5 Plus 2026-02-15 (medium) की benchmark लागत कम है: $0.567 vs $0.767. Qwen3.5 Plus 2026-02-15 (medium) तेज है: 97.68s vs 144.88s, pass rates 59.4% vs 72.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-03

तुलना किए गए मॉडल

रैंक
#147
कुल आउटपुट टोकन
422,234
प्रतिक्रिया समय (औसत)
144.88s
कुल लागत
$0.767
रैंक
#142
कुल आउटपुट टोकन
302,730
प्रतिक्रिया समय (औसत)
97.68s
कुल लागत
$0.567
अनुशंसित मॉडल Qwen3.5 Plus 2026-02-15 (medium)

It has the strongest score in this comparison (7.2) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium रिलीज़: 2026-02-15
स्कोर 7.2 7.2
रैंक #147 #142
विश्वसनीयता 10.0 10.0
संगति 9.0 7.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 72.5%
अस्थिर टेस्ट 3 6
कुल रन 69 69
प्रति परिणाम लागत 4.942 4.047
कुल लागत $0.767 $0.567
इनपुट कीमत $0.300 / 1M $0.260 / 1M
आउटपुट कीमत $1.200 / 1M $1.560 / 1M
कैश पढ़ने की कीमत $0.006 / 1M लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 287,669 249,486
आउटपुट टोकन 47,204 14,481
रीजनिंग टोकन 375,030 288,249
प्रतिक्रिया समय (औसत) 144.88s 97.68s
प्रतिक्रिया समय (अधिकतम) 939.52s 304.85s
प्रतिक्रिया समय (कुल) 3332.19s 1562.81s
पैरामीटर 1.6T कुल (48B सक्रिय) ~397B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#147 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#142 Qwen3.5 Plus 2026-02-15

medium
लागत
$0.011
समय
125.5s
टोकन
7,040 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

त्वरित तुलना

तुलना जोड़ी बदलें