नेव्हिगेशन
AI BENCHY
Advertise here

LongCat 2.0 vs Qwen3.6 Max Preview

average score जवळपास समान आहे: 6.4 vs 6.4. LongCat 2.0 चा benchmark खर्च कमी आहे: $0.044 vs $0.228. LongCat 2.0 वेगवान आहे: 5.17s vs 7.82s, pass rates 40.9% vs 56.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-03

क्रमांक
#172
एकूण आउटपुट टोकन्स
9,375
प्रतिसाद वेळ (सरासरी)
5.17s
एकूण खर्च
$0.044
क्रमांक
#169
एकूण आउटपुट टोकन्स
19,257
प्रतिसाद वेळ (सरासरी)
7.82s
एकूण खर्च
$0.228
शिफारस केलेले मॉडेल LongCat 2.0

It has the best score here (6.4), while costing about 5.2x less than Qwen3.6 Max Preview.

तपशीलवार तुलना

मेट्रिक LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20 Qwen3.6 Max Preview Qwen3.6 Max Preview none प्रकाशन: 2026-04-20
स्कोअर 6.4 6.4
क्रमांक #172 #169
विश्वसनीयता 10.0 9.9
सुसंगतता 9.3 9.3
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 40.9% 56.1%
अस्थिर चाचण्या 2 2
एकूण रन 66 66
प्रति निकाल खर्च 0.549 2.248
एकूण खर्च $0.044 $0.228
इनपुट किंमत $0.300 / 1M $1.028 / 1M
आउटपुट किंमत $1.200 / 1M $6.162 / 1M
एकूण इनपुट टोकन्स 108,752 106,348
आउटपुट टोकन्स 9,375 19,257
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 5.17s 7.82s
प्रतिसाद वेळ (कमाल) 48.38s 102.62s
प्रतिसाद वेळ (एकूण) 113.83s 172.04s
पॅरामीटर्स 1.6T एकूण (48B सक्रिय) ~1T एकूण (~40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

#169 Qwen3.6 Max Preview

none
खर्च
$0.025
वेळ
83.9s
टोकन्स
4,066 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0

झटपट तुलना

तुलना जोडी बदला