Navigasi
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Z.ai: GLM 5.2

LongCat 2.0 (low) unggul dalam skor rata-rata dengan 6.7 vs 6.6. GLM 5.2 memiliki biaya benchmark lebih rendah di $0.151 vs $0.391. GLM 5.2 lebih cepat di 9.34s vs 100.31s, dengan tingkat keberhasilan 53.0% vs 59.1%.

Model yang direkomendasikanGLM 5.2Its score stays close to the best score here (6.6 vs 6.7), while costing about 2.6x less than LongCat 2.0 (low).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-20

Metrik LongCat 2.0 LongCat 2.0 low Rilis: 2026-07-20 GLM 5.2 GLM 5.2 none Rilis: 2026-06-17
Skor 6.7 6.6
Peringkat #91 #96
Keandalan 9.6 10.0
Konsistensi 8.9 9.2
Tes benar
Tingkat lulus per percobaan 53.0% 59.1%
Tes tidak stabil 3 2
Total Run 66 64
Biaya per hasil 3.910 1.421
Total Biaya $0.391 $0.151
Harga input $0.300 / 1M $0.960 / 1M
Harga output $1.200 / 1M $3.014 / 1M
Total token input 90,909 112,359
Token output 5,679 14,340
Token penalaran 297,369 0
Waktu respons (rata-rata) 100.31s 9.34s
Waktu respons (maks) 560.39s 79.65s
Waktu respons (total) 2206.82s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
Biaya
$0.024
Waktu
428.0s
Token
19,557 tok

#96 GLM 5.2

none
SVG tidak valid
Biaya
$0.033
Waktu
87.7s
Token
7,455 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

Perbandingan Cepat

Ganti Pasangan Perbandingan