नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (medium) vs Qwen3.8 Flash Next (xhigh)

LongCat 2.0 (medium) average score में आगे है: 7.2 vs 7.1. Qwen3.8 Flash Next (xhigh) की benchmark लागत कम है: ~$0.195 vs $0.767. Qwen3.8 Flash Next (xhigh) तेज है: 102.66s vs 144.88s, pass rates 59.4% vs 72.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-05

तुलना किए गए मॉडल

रैंक
#149
कुल आउटपुट टोकन
422,234
प्रतिक्रिया समय (औसत)
144.88s
कुल लागत
$0.767
रैंक
#154
कुल आउटपुट टोकन
621,056
प्रतिक्रिया समय (औसत)
102.66s
कुल लागत
~$0.195
अनुशंसित मॉडल Qwen3.8 Flash Next (xhigh)

Its score stays close to the best score here (7.1 vs 7.2), while costing about 3.9x less than LongCat 2.0 (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh रिलीज़: 2026-10-04
स्कोर 7.2 7.1
रैंक #149 #154
विश्वसनीयता 10.0 9.9
संगति 9.0 7.9
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 72.5%
अस्थिर टेस्ट 3 6
कुल रन 69 69
प्रति परिणाम लागत 4.942 ~1.390
कुल लागत $0.767 ~$0.195
इनपुट कीमत $0.300 / 1M लागू नहीं
आउटपुट कीमत $1.200 / 1M लागू नहीं
कैश पढ़ने की कीमत $0.006 / 1M लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 287,669 301,749
आउटपुट टोकन 47,204 1,033
रीजनिंग टोकन 375,030 620,023
प्रतिक्रिया समय (औसत) 144.88s 102.66s
प्रतिक्रिया समय (अधिकतम) 939.52s 674.08s
प्रतिक्रिया समय (कुल) 3332.19s 2361.10s
पैरामीटर 1.6T कुल (48B सक्रिय) 180B कुल (6B सक्रिय)
उपलब्धता मुक्त स्रोत वेट उपलब्ध

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#149 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#154 Qwen3.8 Flash Next

xhigh
लागत
~$0.010
समय
333.1s
टोकन
30,654 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070

त्वरित तुलना

तुलना जोड़ी बदलें

LongCat 2.0mediumvsStep 3.7 FlashlowLongCat 2.0mediumvsQwen3.7 FlashhighClaude Opus 4.8lowvsLongCat 2.0mediumClaude Opus 5nonevsLongCat 2.0mediumQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumGemini 3.8 FlashlowvsLongCat 2.0mediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowClaude Opus 5nonevsQwen3.8 Flash NextxhighQwen3.8 Flash NextxhighvsMiMo-V2.5mediumLongCat 2.0mediumvsQwen3.5-27BnoneQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.8 Flash NextxhighvsGLM 5medium