नेविगेशन
AI BENCHY
Advertise here

LongCat 2.0 vs Qwen3.6 27B (medium)

Qwen3.6 27B (medium) average score में आगे है: 6.5 vs 6.4. LongCat 2.0 की benchmark लागत कम है: $0.044 vs $1.045. LongCat 2.0 तेज है: 5.17s vs 106.06s, pass rates 40.9% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#157
कुल आउटपुट टोकन
9,375
प्रतिक्रिया समय (औसत)
5.17s
कुल लागत
$0.044
रैंक
#150
कुल आउटपुट टोकन
272,573
प्रतिक्रिया समय (औसत)
106.06s
कुल लागत
$1.045
अनुशंसित मॉडल LongCat 2.0

Its score stays close to the best score here (6.4 vs 6.5), while costing about 23.8x less than Qwen3.6 27B (medium).

विस्तृत तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium रिलीज़: 2026-04-20
स्कोर 6.4 6.5
रैंक #157 #150
विश्वसनीयता 10.0 10.0
संगति 9.3 7.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 40.9% 60.6%
अस्थिर टेस्ट 2 7
कुल रन 66 66
प्रति परिणाम लागत 0.549 7.448
कुल लागत $0.044 $1.045
इनपुट कीमत $0.300 / 1M $0.600 / 1M
आउटपुट कीमत $1.200 / 1M $3.600 / 1M
कुल इनपुट टोकन 108,752 106,176
आउटपुट टोकन 9,375 33,013
रीजनिंग टोकन 0 239,560
प्रतिक्रिया समय (औसत) 5.17s 106.06s
प्रतिक्रिया समय (अधिकतम) 48.38s 1085.11s
प्रतिक्रिया समय (कुल) 113.83s 2333.36s
पैरामीटर 1.6T कुल (48B सक्रिय) 27B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

#150 Qwen3.6 27B

medium
लागत
$0.009
समय
39.6s
टोकन
3,090 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

त्वरित तुलना

तुलना जोड़ी बदलें