- Peringkat
- #138
- Total token output
- 404,635
- Waktu respons (rata-rata)
- 151.67s
- Total Biaya
- $0.778
LongCat 2.0 (high) vs GLM 5 (medium)
LongCat 2.0 (high) unggul dalam skor rata-rata dengan 7.3 vs 7.2. GLM 5 (medium) memiliki biaya benchmark lebih rendah di $0.479 vs $0.778. GLM 5 (medium) lebih cepat di 39.05s vs 151.67s, dengan tingkat keberhasilan 53.6% vs 76.8%.
Model yang Dibandingkan
- Peringkat
- #148
- Total token output
- 138,257
- Waktu respons (rata-rata)
- 39.05s
- Total Biaya
- $0.479
Model yang direkomendasikan
GLM 5 (medium)
Its score stays close to the best score here (7.2 vs 7.3), while costing about 1.6x less than LongCat 2.0 (high).
Perbandingan terperinci
| Metrik | LongCat 2.0 LongCat 2.0 high | GLM 5 GLM 5 medium |
|---|---|---|
| Skor | 7.3 | 7.2 |
| Peringkat | #138 | #148 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 8.5 | 7.9 |
| Percobaan | 69/69 | 66/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 53.6% | 76.8% |
| Tes tidak stabil | 4 | 5 |
| Total Run | 69 | 66 |
| Biaya per hasil | 5.681 | 2.552 |
| Total Biaya | $0.778 | $0.479 |
| Harga input | $0.300 / 1M | $0.600 / 1M |
| Harga output | $1.200 / 1M | $1.920 / 1M |
| Harga baca cache | $0.006 / 1M | $0.120 / 1M |
| Harga tulis cache | T/A | T/A |
| Total token input | 275,080 | 212,440 |
| Token output | 32,447 | 22,922 |
| Token penalaran | 372,188 | 115,335 |
| Waktu respons (rata-rata) | 151.67s | 39.05s |
| Waktu respons (maks) | 941.66s | 110.70s |
| Waktu respons (total) | 3488.43s | 546.68s |
| Parameter | 1.6T total (48B aktif) | 744B total (40B aktif) |
| Ketersediaan | Sumber terbuka | Sumber terbuka |
Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#138 LongCat 2.0
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Biaya
- $0.000
- Waktu
- 600.0s
- Token
- 0 tok
#148 GLM 5
medium- Biaya
- $0.005
- Waktu
- 20.7s
- Token
- 2,068 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 116.07s | 181,669 | 1,977 | 16,016 | |
| GLM 5 | 4.7 | 3.1 | 33.3% | 1 | 110.70s | 177,216 | 1,352 | 12,339 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 8.9 | 8.1 | 91.7% | 1 | 7.76s | 588 | 303 | 3,300 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 23.66s | 555 | 480 | 7,056 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.8 | 9.3 | 66.7% | 0 | 505.33s | 6,913 | 244 | 192,377 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 74.30s | 7,254 | 2,997 | 52,930 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 167.13s | 68,941 | 4,934 | 49,558 | |
| GLM 5 | 5.0 | 5.0 | 50.0% | 0 | 28.96s | 12,804 | 662 | 3,242 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 5.8 | 33.3% | 1 | 10.98s | 7,653 | 197 | 2,714 | |
| GLM 5 | 7.1 | 5.6 | 83.3% | 1 | 8.90s | 5,508 | 567 | 3,734 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 7.2 | 22.2% | 1 | 433.73s | 505 | 23,928 | 86,947 | |
| GLM 5 | 3.5 | 4.4 | 33.3% | 2 | 0ms | 260 | 13,176 | 14,137 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.1 | 10.0 | 0.0% | 0 | 17.00s | 480 | 111 | 1,748 | |
| GLM 5 | 6.1 | 3.1 | 66.7% | 1 | 14.69s | 477 | 2,020 | 2,248 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 6.96s | 657 | 78 | 1,726 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 7.25s | 636 | 1,001 | 2,129 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.1 | 7.4 | 11.1% | 1 | 9.18s | 636 | 379 | 2,778 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 11.33s | 609 | 33 | 4,076 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.02s | 6,840 | 249 | 505 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 15.93s | 6,935 | 233 | 994 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 99.44s | 198 | 47 | 14,519 | |
| GLM 5 | 3.0 | 10.0 | 0.0% | 0 | 67.37s | 186 | 401 | 12,450 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Gemini 2.5 FlashmediumvsLongCat 2.0highStep 3.7 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.6 PlusmediumGemini 3.5 Flash LitemediumvsLongCat 2.0highLongCat 2.0highvsGrok 4.7mediumQwen3.7 FlashhighvsGLM 5mediumClaude Fable 5.1mediumvsLongCat 2.0highClaude Opus 5nonevsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGemini 3.8 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.5-27BnoneLongCat 2.0highvsQwen3.5 Plus 2026-02-15medium