नेव्हिगेशन
Advertise here

LongCat 2.0 (medium) vs Qwen3.5-27B

Qwen3.5-27B average score मध्ये पुढे आहे: 7.2 vs 7.2. Qwen3.5-27B चा benchmark खर्च कमी आहे: $0.116 vs $0.593. Qwen3.5-27B वेगवान आहे: 9.98s vs 144.88s, pass rates 59.4% vs 47.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#145
एकूण आउटपुट टोकन्स
422,234
प्रतिसाद वेळ (सरासरी)
144.88s
एकूण खर्च
$0.593
क्रमांक
#139
एकूण आउटपुट टोकन्स
36,422
प्रतिसाद वेळ (सरासरी)
9.98s
एकूण खर्च
$0.116
शिफारस केलेले मॉडेल Qwen3.5-27B

It has the best score here (7.2), while costing about 5.1x less than LongCat 2.0 (medium).

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 medium प्रकाशन: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 7.2 7.2
क्रमांक #145 #139
विश्वसनीयता 10.0 10.0
सुसंगतता 9.0 9.4
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.4% 47.8%
अस्थिर चाचण्या 3 2
एकूण रन 69 69
प्रति निकाल खर्च 4.942 1.153
एकूण खर्च $0.593 $0.116
इनपुट किंमत $0.300 / 1M $0.195 / 1M
आउटपुट किंमत $1.200 / 1M $1.560 / 1M
एकूण इनपुट टोकन्स 287,669 283,977
आउटपुट टोकन्स 47,204 36,422
रिझनिंग टोकन्स 375,030 0
प्रतिसाद वेळ (सरासरी) 144.88s 9.98s
प्रतिसाद वेळ (कमाल) 939.52s 124.53s
प्रतिसाद वेळ (एकूण) 3332.19s 229.52s
पॅरामीटर्स 1.6T एकूण (48B सक्रिय) 27B
उपलब्धता मुक्त स्रोत मुक्त स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 LongCat 2.0

medium
खर्च
$0.016
वेळ
285.1s
टोकन्स
13,057 tok

#139 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला