AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#97

LongCat 2.0

Meituan Releasedatum: 2026-07-20 Getest op: 2026-07-20 17:01 meituan/longcat-2.0::high
1.6T totaal (48B actief)MoEOpen-source

Samenvatting

LongCat 2.0 scoort 6.6 op AI BENCHY en staat op #97. Het model heeft 9.4 betrouwbaarheid, een slagingspercentage van 53.0%, $0.469 totale kosten en 148.73s gemiddelde responstijd.

Modelgegevens

Onderzocht op 2026-08-12

Gerapporteerd
Parameters
1.6T totaal (48B actief)
Architectuur
MoE
Beschikbaarheid
Open-source
Licentie
MIT

Score

6.6

Consistentie

8.2

Totaal aantal uitvoer-tokens

366,791

Totaal aantal invoer-tokens

93,357

Invoerprijs

$0.300 / 1M

Uitvoerprijs

$1.200 / 1M

Correcte tests

Foute tests: 13

Slaagpercentage per poging: 53.0%

Instabiele tests

5

Instabiele tests hadden gemengde uitkomsten over runs (minstens één geslaagd en één gefaald).

Responstijd (gem.)

148.73s

Responstijd (max): 941.66s

Responstijd (totaal): 3272.00s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
600.0s
Tokens
0 tok

Rungeschiedenis

Getest op Score Betrouwbaarheid Correcte tests Totale kosten Vergelijken
2026-08-14 04:15 Hertest 6.7 10.0 $0.492 Vergelijken
2026-07-20 17:01 Eerste run 6.6 9.4 $0.469 Huidige run

Prijsgeschiedenis

Historische prijsgegevens voor dit model van OpenRouter.

Datum Invoerprijs Uitvoerprijs
2026-07-20 17:49 $0.300 / 1M $1.200 / 1M

Grafieken

Kies eerst het eerste model en klik daarna op een tweede model om een zij-aan-zijpagina te openen.

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Snelle vergelijking

Categorie-uitsplitsing

Categorie Score Consistentie Correcte tests
Anti-AI-trucs 8.9 8.1
Programmeren 7.6 7.2
Gecombineerd 10.0 10.0
Gegevensparsering en extractie 3.6 5.8
Domeinspecifiek 3.6 7.2
Algemene intelligentie 5.1 10.0
Instructies opvolgen 6.5 10.0
Puzzeloplossing 3.1 7.4
Toolaanroepen 10.0 10.0
Algemene kennis 3.0 10.0

Vergeleken modellen