नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-27B

Qwen3.5-27B average score मध्ये पुढे आहे: 6.5 vs 6.3. LongCat 2.0 चा benchmark खर्च कमी आहे: $0.044 vs $0.090. Qwen3.5-27B वेगवान आहे: 4.76s vs 5.18s, pass rates 36.4% vs 40.9%.

शिफारस केलेले मॉडेलQwen3.5-27BIt has the strongest score in this comparison (6.5) and the best overall balance of cost and response time across all 2 models.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-20

मेट्रिक LongCat 2.0 LongCat 2.0 none प्रकाशन: 2026-07-20 Qwen3.5-27B Qwen3.5-27B none प्रकाशन: 2026-02-24
स्कोअर 6.3 6.5
क्रमांक #111 #103
विश्वसनीयता 10.0 10.0
सुसंगतता 9.3 9.3
बरोबर चाचण्या
प्रति प्रयत्न पास दर 36.4% 40.9%
अस्थिर चाचण्या 2 2
एकूण रन 66 66
प्रति निकाल खर्च 0.627 0.763
एकूण खर्च $0.044 $0.090
इनपुट किंमत $0.300 / 1M $0.260 / 1M
आउटपुट किंमत $1.200 / 1M $2.600 / 1M
एकूण इनपुट टोकन्स 108,743 102,316
आउटपुट टोकन्स 9,372 24,321
रिझनिंग टोकन्स 0 0
प्रतिसाद वेळ (सरासरी) 5.18s 4.76s
प्रतिसाद वेळ (कमाल) 48.38s 69.46s
प्रतिसाद वेळ (एकूण) 113.95s 104.71s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 LongCat 2.0

none
खर्च
$0.027
वेळ
411.7s
टोकन्स
22,283 tok

#103 Qwen3.5-27B

none
खर्च
$0.007
वेळ
42.9s
टोकन्स
4,273 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

झटपट तुलना

तुलना जोडी बदला