नेव्हिगेशन
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 27B

LongCat 2.0 (high) average score मध्ये पुढे आहे: 6.6 vs 6.5. LongCat 2.0 (high) चा benchmark खर्च कमी आहे: $0.469 vs $0.779. Qwen3.6 27B (medium) वेगवान आहे: 106.32s vs 148.73s, pass rates 53.0% vs 59.1%.

शिफारस केलेले मॉडेलLongCat 2.0 (high)It has the best score here (6.6), while costing about 1.7x less than Qwen3.6 27B (medium).

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-21

मेट्रिक LongCat 2.0 LongCat 2.0 high प्रकाशन: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium प्रकाशन: 2026-04-20
स्कोअर 6.6 6.5
क्रमांक #102 #105
विश्वसनीयता 9.4 10.0
सुसंगतता 8.2 8.0
बरोबर चाचण्या
प्रति प्रयत्न पास दर 53.0% 59.1%
अस्थिर चाचण्या 5 6
एकूण रन 66 66
प्रति निकाल खर्च 5.202 7.319
एकूण खर्च $0.469 $0.779
इनपुट किंमत $0.300 / 1M $0.450 / 1M
आउटपुट किंमत $1.200 / 1M $2.700 / 1M
एकूण इनपुट टोकन्स 93,357 106,167
आउटपुट टोकन्स 30,466 32,889
रिझनिंग टोकन्स 336,325 241,303
प्रतिसाद वेळ (सरासरी) 148.73s 106.32s
प्रतिसाद वेळ (कमाल) 941.66s 1085.11s
प्रतिसाद वेळ (एकूण) 3272.00s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 LongCat 2.0

high
अवैध SVG
खर्च
$0.000
वेळ
600.0s
टोकन्स
0 tok

#105 Qwen3.6 27B

medium
खर्च
$0.009
वेळ
39.6s
टोकन्स
3,090 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

झटपट तुलना

तुलना जोडी बदला