Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 vs Laguna XS 2.1 (medium)

Laguna XS 2.1 (medium) leidt in gemiddelde score met 6.5 vs 6.4. LongCat 2.0 heeft lagere benchmarkkosten met $0.044 vs $0.068. LongCat 2.0 is sneller met 5.17s vs 48.18s, met slagingspercentages van 40.9% vs 45.5%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-03

Rang
#172
Totaal aantal uitvoer-tokens
9,375
Responstijd (gem.)
5.17s
Totale kosten
$0.044
Rang
#166
Totaal aantal uitvoer-tokens
522,480
Responstijd (gem.)
48.18s
Totale kosten
$0.068
Aanbevolen model LongCat 2.0

De score blijft dicht bij de beste score hier (6.4 vs 6.5) en het kost ongeveer 1.5x minder dan Laguna XS 2.1 (medium).

Gedetailleerde vergelijking

Metriek LongCat 2.0 LongCat 2.0 none Releasedatum: 2026-07-20 Laguna XS 2.1 Laguna XS 2.1 medium Releasedatum: 2026-07-02 Gratis beschikbaar
Score 6.4 6.5
Rang #172 #166
Betrouwbaarheid 10.0 10.0
Consistentie 9.3 9.2
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 40.9% 45.5%
Instabiele tests 2 2
Totaal runs 66 66
Kosten per resultaat 0.549 0.745
Totale kosten $0.044 $0.068
Invoerprijs $0.300 / 1M $0.060 / 1M
Uitvoerprijs $1.200 / 1M $0.120 / 1M
Totaal aantal invoer-tokens 108,752 118,998
Uitvoer-tokens 9,375 30,750
Redeneer-tokens 0 491,730
Responstijd (gem.) 5.17s 48.18s
Responstijd (max) 48.38s 422.72s
Responstijd (totaal) 113.83s 1059.93s
Parameters 1.6T totaal (48B actief) 33B totaal (3B actief)
Beschikbaarheid Open-source Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 LongCat 2.0

none
Kosten
$0.027
Tijd
411.7s
Tokens
22,283 tok

#166 Laguna XS 2.1

medium
Kosten
$0.001
Tijd
30.6s
Tokens
4,678 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258

Snelle vergelijking

Vergelijkingspaar wisselen