Navigasi
Advertise here

LongCat 2.0 (low) vs GLM 5.3 Flash (low)

Skor rata-rata hampir imbang di 6.6 vs 6.6. GLM 5.3 Flash (low) memiliki biaya benchmark lebih rendah di $0.038 vs $0.630. GLM 5.3 Flash (low) lebih cepat di 11.82s vs 115.00s, dengan tingkat keberhasilan 55.1% vs 58.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-09

Model yang Dibandingkan

Peringkat
#201
Total token output
346,225
Waktu respons (rata-rata)
115.00s
Total Biaya
$0.630
Peringkat
#197
Total token output
27,168
Waktu respons (rata-rata)
11.82s
Total Biaya
$0.038
Model yang direkomendasikan GLM 5.3 Flash (low)

It has the best score here (6.6), while costing about 17.0x less than LongCat 2.0 (low).

Perbandingan terperinci

Metrik LongCat 2.0 LongCat 2.0 low Rilis: 2026-07-20 GLM 5.3 Flash GLM 5.3 Flash low Rilis: 2026-08-26
Skor 6.6 6.6
Peringkat #201 #197
Keandalan 9.9 10.0
Konsistensi 8.3 8.5
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 55.1% 58.0%
Tes tidak stabil 5 4
Total Run 69 69
Biaya per hasil 4.942 0.338
Total Biaya $0.630 $0.038
Harga input $0.300 / 1M $0.150 / 1M
Harga output $1.200 / 1M $0.500 / 1M
Harga baca cache $0.006 / 1M $0.030 / 1M
Harga tulis cache T/A T/A
Total token input 262,387 255,173
Token output 7,344 9,891
Token penalaran 338,881 17,277
Waktu respons (rata-rata) 115.00s 11.82s
Waktu respons (maks) 560.39s 90.45s
Waktu respons (total) 2645.11s 271.92s
Parameter 1.6T total (48B aktif) 320B total (18B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#201 LongCat 2.0

low
Biaya
$0.024
Waktu
428.0s
Token
19,557 tok

#197 GLM 5.3 Flash

low
Biaya
$0.001
Waktu
20.7s
Token
1,482 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.3 Flash 5.4 7.2 44.4% 1 10.38s 7,317 398 3,973

Ganti Pasangan Perbandingan