नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-35B-A3B

LongCat 2.0 average score मध्ये पुढे आहे: 6.3 vs 6.2. LongCat 2.0 चा benchmark खर्च कमी आहे: $0.044 vs $0.837. LongCat 2.0 वेगवान आहे: 5.18s vs 112.47s, pass rates 36.4% vs 66.7%.

शिफारस केलेले मॉडेलLongCat 2.0It has the best score here (6.3), while costing about 19.1x less than Qwen3.5-35B-A3B (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium प्रकाशन: 2026-02-24
स्कोअर 6.3 6.2
क्रमांक #111 #119
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 7.6
बरोबर चाचण्या
प्रति प्रयत्न पास दर 36.4% 66.7%
अस्थिर चाचण्या 2 6
एकूण रन 66 66
प्रति निकाल खर्च 0.627 9.130
एकूण खर्च $0.044 $0.837
इनपुट किंमत $0.300 / 1M $0.140 / 1M
आउटपुट किंमत $1.200 / 1M $1.000 / 1M
एकूण इनपुट टोकन्स 108,743 130,388
आउटपुट टोकन्स 9,372 40,630
रिझनिंग टोकन्स 0 786,040
प्रतिसाद वेळ (सरासरी) 5.18s 112.47s
प्रतिसाद वेळ (कमाल) 48.38s 950.25s
प्रतिसाद वेळ (एकूण) 113.95s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

#119 Qwen3.5-35B-A3B

medium
खर्च
$0.009
वेळ
71.4s
टोकन्स
8,631 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

झटपट तुलना

तुलना जोडी बदला