Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (high) vs Qwen3.8 27B (medium)

LongCat 2.0 (high) leidt in gemiddelde score met 7.3 vs 7.2. Qwen3.8 27B (medium) heeft lagere benchmarkkosten met ~$0.073 vs $0.569. Qwen3.8 27B (medium) is sneller met 40.09s vs 151.67s, met slagingspercentages van 53.6% vs 66.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#136
Totaal aantal uitvoer-tokens
404,635
Responstijd (gem.)
151.67s
Totale kosten
$0.569
Rang
#141
Totaal aantal uitvoer-tokens
170,696
Responstijd (gem.)
40.09s
Totale kosten
~$0.073
Aanbevolen model Qwen3.8 27B (medium)

De score blijft dicht bij de beste score hier (7.2 vs 7.3) en het kost ongeveer 7.8x minder dan LongCat 2.0 (high).

Gedetailleerde vergelijking

Metriek LongCat 2.0 LongCat 2.0 high Releasedatum: 2026-07-20 Qwen3.8 27B Qwen3.8 27B medium Releasedatum: 2026-08-14 Gratis beschikbaar
Score 7.3 7.2
Rang #136 #141
Betrouwbaarheid 10.0 9.7
Consistentie 8.5 9.4
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 53.6% 66.7%
Instabiele tests 4 2
Totaal runs 69 69
Kosten per resultaat 5.681 ~0.520
Totale kosten $0.569 ~$0.073
Invoerprijs $0.300 / 1M n.v.t.
Uitvoerprijs $1.200 / 1M n.v.t.
Totaal aantal invoer-tokens 275,080 277,164
Uitvoer-tokens 32,447 1,913
Redeneer-tokens 372,188 168,783
Responstijd (gem.) 151.67s 40.09s
Responstijd (max) 941.66s 214.63s
Responstijd (totaal) 3488.43s 881.89s
Parameters 1.6T totaal (48B actief) 27.3B
Beschikbaarheid Open-source Gewichten beschikbaar

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
600.0s
Tokens
0 tok

#141 Qwen3.8 27B

medium
Kosten
~$0.002
Tijd
43.4s
Tokens
2,956 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

Snelle vergelijking

Vergelijkingspaar wisselen