Urambazaji
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs OpenAI: GPT-5.5

GPT-5.5 (low) inaongoza kwa average score: 9.3 vs 7.4. LongCat 2.0 (medium) ina gharama ya chini ya benchmark: $0.478 vs $1.253. GPT-5.5 (low) ni ya haraka zaidi: 10.13s vs 136.64s, na pass rates 60.6% vs 86.4%.

Muundo unaopendekezwaGPT-5.5 (low)It has the best score here (9.3), while responding about 13.5x faster than LongCat 2.0 (medium).

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-20

Kipimo LongCat 2.0 LongCat 2.0 medium Toleo: 2026-07-20 GPT-5.5 GPT-5.5 low Toleo: 2026-04-24
Alama 7.4 9.3
Nafasi #60 #6
Uaminifu 9.8 10.0
Uthabiti 8.9 10.0
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 60.6% 86.4%
Majaribio yasiyo thabiti 3 0
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 3.978 6.594
Jumla ya gharama $0.478 $1.253
Bei ya ingizo $0.300 / 1M $5.000 / 1M
Bei ya toleo $1.200 / 1M $30.000 / 1M
Jumla ya tokeni za ingizo 97,315 80,058
Tokeni za matokeo 44,384 5,378
Tokeni za hoja 329,012 23,040
Muda wa majibu (wastani) 136.64s 10.13s
Muda wa majibu (upeo) 939.52s 56.19s
Muda wa majibu (jumla) 3006.01s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 LongCat 2.0

medium
Gharama
$0.016
Muda
285.1s
Tokeni
13,057 tok

#6 GPT-5.5

low
Gharama
$0.068
Muda
37.0s
Tokeni
2,339 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho