Urambazaji
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 27B

LongCat 2.0 (low) inaongoza kwa average score: 6.7 vs 6.5. LongCat 2.0 (low) ina gharama ya chini ya benchmark: $0.391 vs $0.779. LongCat 2.0 (low) ni ya haraka zaidi: 100.31s vs 106.32s, na pass rates 53.0% vs 59.1%.

Muundo unaopendekezwaLongCat 2.0 (low)It has the best score here (6.7), while costing about 2.0x less than Qwen3.6 27B (medium).

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-21

Kipimo LongCat 2.0 LongCat 2.0 low Toleo: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium Toleo: 2026-04-20
Alama 6.7 6.5
Nafasi #96 #105
Uaminifu 9.6 10.0
Uthabiti 8.9 8.0
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 53.0% 59.1%
Majaribio yasiyo thabiti 3 6
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 3.910 7.319
Jumla ya gharama $0.391 $0.779
Bei ya ingizo $0.300 / 1M $0.450 / 1M
Bei ya toleo $1.200 / 1M $2.700 / 1M
Jumla ya tokeni za ingizo 90,909 106,167
Tokeni za matokeo 5,679 32,889
Tokeni za hoja 297,369 241,303
Muda wa majibu (wastani) 100.31s 106.32s
Muda wa majibu (upeo) 560.39s 1085.11s
Muda wa majibu (jumla) 2206.82s 2339.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
Gharama
$0.024
Muda
428.0s
Tokeni
19,557 tok

#105 Qwen3.6 27B

medium
Gharama
$0.009
Muda
39.6s
Tokeni
3,090 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho