Urambazaji
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 (low) inaongoza kwa average score: 9.3 vs 6.6. LongCat 2.0 (high) ina gharama ya chini ya benchmark: $0.469 vs $1.253. GPT-5.5 (low) ni ya haraka zaidi: 10.13s vs 148.73s, na pass rates 53.0% vs 86.4%.

Muundo unaopendekezwaGPT-5.5 (low)It has the best score here (9.3), while responding about 14.7x faster than LongCat 2.0 (high).

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-20

Kipimo LongCat 2.0 LongCat 2.0 high Toleo: 2026-07-20 GPT-5.5 GPT-5.5 low Toleo: 2026-04-24
Alama 6.6 9.3
Nafasi #97 #6
Uaminifu 9.4 10.0
Uthabiti 8.2 10.0
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 53.0% 86.4%
Majaribio yasiyo thabiti 5 0
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 5.202 6.594
Jumla ya gharama $0.469 $1.253
Bei ya ingizo $0.300 / 1M $5.000 / 1M
Bei ya toleo $1.200 / 1M $30.000 / 1M
Jumla ya tokeni za ingizo 93,357 80,058
Tokeni za matokeo 30,466 5,378
Tokeni za hoja 336,325 23,040
Muda wa majibu (wastani) 148.73s 10.13s
Muda wa majibu (upeo) 941.66s 56.19s
Muda wa majibu (jumla) 3272.00s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
SVG batili
Gharama
$0.000
Muda
600.0s
Tokeni
0 tok

#6 GPT-5.5

low
Gharama
$0.068
Muda
37.0s
Tokeni
2,339 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
LongCat 2.0 7.6 7.2 77.8% 1 505.33s 6,913 244 192,377
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho