नेविगेशन
Advertise here

LongCat 2.0 (medium) vs Qwen3.5-27B

Qwen3.5-27B average score में आगे है: 7.2 vs 7.2. Qwen3.5-27B की benchmark लागत कम है: $0.116 vs $0.593. Qwen3.5-27B तेज है: 9.98s vs 144.88s, pass rates 59.4% vs 47.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#145
कुल आउटपुट टोकन
422,234
प्रतिक्रिया समय (औसत)
144.88s
कुल लागत
$0.593
रैंक
#139
कुल आउटपुट टोकन
36,422
प्रतिक्रिया समय (औसत)
9.98s
कुल लागत
$0.116
अनुशंसित मॉडल Qwen3.5-27B

It has the best score here (7.2), while costing about 5.1x less than LongCat 2.0 (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium रिलीज़: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24
स्कोर 7.2 7.2
रैंक #145 #139
विश्वसनीयता 10.0 10.0
संगति 9.0 9.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 47.8%
अस्थिर टेस्ट 3 2
कुल रन 69 69
प्रति परिणाम लागत 4.942 1.153
कुल लागत $0.593 $0.116
इनपुट कीमत $0.300 / 1M $0.195 / 1M
आउटपुट कीमत $1.200 / 1M $1.560 / 1M
कुल इनपुट टोकन 287,669 283,977
आउटपुट टोकन 47,204 36,422
रीजनिंग टोकन 375,030 0
प्रतिक्रिया समय (औसत) 144.88s 9.98s
प्रतिक्रिया समय (अधिकतम) 939.52s 124.53s
प्रतिक्रिया समय (कुल) 3332.19s 229.52s
पैरामीटर 1.6T कुल (48B सक्रिय) 27B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 LongCat 2.0

medium
लागत
$0.016
समय
285.1s
टोकन
13,057 tok

#139 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

त्वरित तुलना

तुलना जोड़ी बदलें