नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-27B

LongCat 2.0 (high) average score मध्ये पुढे आहे: 6.6 vs 6.5. Qwen3.5-27B चा benchmark खर्च कमी आहे: $0.090 vs $0.469. Qwen3.5-27B वेगवान आहे: 4.76s vs 148.73s, pass rates 53.0% vs 40.9%.

शिफारस केलेले मॉडेलQwen3.5-27BIts score stays close to the best score here (6.5 vs 6.6), while costing about 5.2x less than LongCat 2.0 (high).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 high प्रकाशन: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 6.6 6.5
क्रमांक #102 #109
विश्वसनीयता 9.4 10.0
सुसंगतता 8.2 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 40.9%
अस्थिर चाचण्या 5 2
एकूण रन 66 66
प्रति निकाल खर्च 5.202 0.763
एकूण खर्च $0.469 $0.090
इनपुट किंमत $0.300 / 1M $0.260 / 1M
आउटपुट किंमत $1.200 / 1M $2.600 / 1M
एकूण इनपुट टोकन्स 93,357 102,316
आउटपुट टोकन्स 30,466 24,321
रिझनिंग टोकन्स 336,325 0
प्रतिसाद वेळ (सरासरी) 148.73s 4.76s
प्रतिसाद वेळ (कमाल) 941.66s 69.46s
प्रतिसाद वेळ (एकूण) 3272.00s 104.71s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 LongCat 2.0

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#109 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला