नेविगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-27B

Qwen3.5-27B average score में आगे है: 6.5 vs 6.3. LongCat 2.0 की benchmark लागत कम है: $0.044 vs $0.090. Qwen3.5-27B तेज है: 4.76s vs 5.18s, pass rates 36.4% vs 40.9%.

अनुशंसित मॉडलQwen3.5-27BIt has the strongest score in this comparison (6.5) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 none रिलीज़: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none रिलीज़: 2026-02-24
स्कोर 6.3 6.5
रैंक #111 #103
विश्वसनीयता 10.0 10.0
संगति 9.3 9.3
सही परीक्षण
प्रति प्रयास पास दर 36.4% 40.9%
अस्थिर टेस्ट 2 2
कुल रन 66 66
प्रति परिणाम लागत 0.627 0.763
कुल लागत $0.044 $0.090
इनपुट कीमत $0.300 / 1M $0.260 / 1M
आउटपुट कीमत $1.200 / 1M $2.600 / 1M
कुल इनपुट टोकन 108,743 102,316
आउटपुट टोकन 9,372 24,321
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 5.18s 4.76s
प्रतिक्रिया समय (अधिकतम) 48.38s 69.46s
प्रतिक्रिया समय (कुल) 113.95s 104.71s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 LongCat 2.0

none
लागत
$0.027
समय
411.7s
टोकन
22,283 tok

#103 Qwen3.5-27B

none
लागत
$0.007
समय
42.9s
टोकन
4,273 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

त्वरित तुलना

तुलना जोड़ी बदलें