Navigare
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 vs Qwen3.5-35B-A3B (medium)

Scorul mediu este practic egal la 6.4 vs 6.3. LongCat 2.0 are costul de benchmark mai mic, $0.104 vs $1.249. LongCat 2.0 este mai rapid cu 8.50s vs 111.54s, cu rate de reușită de 42.0% vs 65.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-01

Modele comparate

Rang
#211
Total tokenuri de ieșire
17,473
Timp de răspuns (mediu)
8.50s
Cost total
$0.104
Rang
#212
Total tokenuri de ieșire
921,628
Timp de răspuns (mediu)
111.54s
Cost total
$1.249
Model recomandat LongCat 2.0

Are cel mai bun scor aici (6.4) și costă de aproximativ 12.0x mai puțin decât Qwen3.5-35B-A3B (medium).

Comparație detaliată

Metrică LongCat 2.0 LongCat 2.0 none Lansare: 2026-07-20 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lansare: 2026-02-24
Scor 6.4 6.3
Rang #211 #212
Fiabilitate 10.0 10.0
Consistență 9.0 7.5
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 42.0% 65.2%
Teste instabile 3 7
Rulări totale 69 69
Cost per rezultat 1.298 10.505
Cost total $0.104 $1.249
Preț de intrare $0.300 / 1M $0.163 / 1M
Preț de ieșire $1.200 / 1M $1.300 / 1M
Total tokenuri de intrare 276,199 378,048
Tokenuri de ieșire 17,473 56,477
Tokenuri de raționament 0 865,151
Timp de răspuns (mediu) 8.50s 111.54s
Timp de răspuns (maxim) 81.77s 950.25s
Timp de răspuns (total) 195.60s 2565.38s
Parametri 1.6T în total (48B activi) 35B în total (3B activi)
Disponibilitate Sursă deschisă Sursă deschisă

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#211 LongCat 2.0

none
Cost
$0.027
Timp
411.7s
Tokenuri
22,283 tok

#212 Qwen3.5-35B-A3B

medium
Cost
$0.009
Timp
71.4s
Tokenuri
8,631 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

Comparație rapidă

Schimbă perechea de comparație