नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 27B

LongCat 2.0 (low) average score मध्ये पुढे आहे: 6.7 vs 6.5. LongCat 2.0 (low) चा benchmark खर्च कमी आहे: $0.391 vs $0.779. LongCat 2.0 (low) वेगवान आहे: 100.31s vs 106.32s, pass rates 53.0% vs 59.1%.

शिफारस केलेले मॉडेलLongCat 2.0 (low)It has the best score here (6.7), while costing about 2.0x less than Qwen3.6 27B (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 low प्रकाशन: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium प्रकाशन: 2026-04-20
स्कोअर 6.7 6.5
क्रमांक #96 #105
विश्वसनीयता 9.6 10.0
सुसंगतता 8.9 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 59.1%
अस्थिर चाचण्या 3 6
एकूण रन 66 66
प्रति निकाल खर्च 3.910 7.319
एकूण खर्च $0.391 $0.779
इनपुट किंमत $0.300 / 1M $0.450 / 1M
आउटपुट किंमत $1.200 / 1M $2.700 / 1M
एकूण इनपुट टोकन्स 90,909 106,167
आउटपुट टोकन्स 5,679 32,889
रिझनिंग टोकन्स 297,369 241,303
प्रतिसाद वेळ (सरासरी) 100.31s 106.32s
प्रतिसाद वेळ (कमाल) 560.39s 1085.11s
प्रतिसाद वेळ (एकूण) 2206.82s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
खर्च
$0.024
वेळ
428.0s
टोकन्स
19,557 tok

#105 Qwen3.6 27B

medium
खर्च
$0.009
वेळ
39.6s
टोकन्स
3,090 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

झटपट तुलना

तुलना जोडी बदला