Navigare
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 (low) vs Qwen3.7 Flash (medium)

Scorul mediu este practic egal la 6.6 vs 6.6. Qwen3.7 Flash (medium) are costul de benchmark mai mic, $0.076 vs $0.495. Qwen3.7 Flash (medium) este mai rapid cu 51.80s vs 115.00s, cu rate de reușită de 55.1% vs 62.3%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-01

Modele comparate

Rang
#188
Total tokenuri de ieșire
346,225
Timp de răspuns (mediu)
115.00s
Cost total
$0.495
Rang
#187
Total tokenuri de ieșire
514,925
Timp de răspuns (mediu)
51.80s
Cost total
$0.076
Model recomandat Qwen3.7 Flash (medium)

Are cel mai bun scor aici (6.6) și costă de aproximativ 6.5x mai puțin decât LongCat 2.0 (low).

Comparație detaliată

Metrică LongCat 2.0 LongCat 2.0 low Lansare: 2026-07-20 Qwen3.7 Flash Qwen3.7 Flash medium Lansare: 2026-07-28
Scor 6.6 6.6
Rang #188 #187
Fiabilitate 9.9 10.0
Consistență 8.3 7.3
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 55.1% 62.3%
Teste instabile 5 8
Rulări totale 69 69
Cost per rezultat 4.942 0.760
Cost total $0.495 $0.076
Preț de intrare $0.300 / 1M $0.030 / 1M
Preț de ieșire $1.200 / 1M $0.130 / 1M
Total tokenuri de intrare 262,387 300,394
Tokenuri de ieșire 7,344 14,081
Tokenuri de raționament 338,881 500,844
Timp de răspuns (mediu) 115.00s 51.80s
Timp de răspuns (maxim) 560.39s 593.64s
Timp de răspuns (total) 2645.11s 1191.42s
Parametri 1.6T în total (48B activi) ~35B în total (~3B activi)
Disponibilitate Sursă deschisă Închis

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 LongCat 2.0

low
Cost
$0.024
Timp
428.0s
Tokenuri
19,557 tok

#187 Qwen3.7 Flash

medium
Reached the allocated time limit (600 seconds) without receiving showcase output.
Cost
$0.000
Timp
600.0s
Tokenuri
0 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.7 Flash 6.2 6.9 55.6% 1 46.78s 7,893 563 61,902

Comparație rapidă

Schimbă perechea de comparație