- Peringkat
- #212
- Total token output
- 17,473
- Waktu respons (rata-rata)
- 8.50s
- Total Biaya
- $0.104
LongCat 2.0 vs Kimi K2.5 (medium)
Skor rata-rata hampir imbang di 6.4 vs 6.4. LongCat 2.0 memiliki biaya benchmark lebih rendah di $0.104 vs $0.603. LongCat 2.0 lebih cepat di 8.50s vs 125.76s, dengan tingkat keberhasilan 42.0% vs 60.9%.
Model yang Dibandingkan
- Peringkat
- #206
- Total token output
- 241,096
- Waktu respons (rata-rata)
- 125.76s
- Total Biaya
- $0.603
Model yang direkomendasikan
LongCat 2.0
It has the best score here (6.4), while costing about 5.8x less than Kimi K2.5 (medium).
Perbandingan terperinci
| Metrik | LongCat 2.0 LongCat 2.0 none | Kimi K2.5 Kimi K2.5 medium |
|---|---|---|
| Skor | 6.4 | 6.4 |
| Peringkat | #212 | #206 |
| Keandalan | 10.0 | 9.6 |
| Konsistensi | 9.0 | 7.1 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 42.0% | 60.9% |
| Tes tidak stabil | 3 | 8 |
| Total Run | 69 | 69 |
| Biaya per hasil | 1.298 | 6.085 |
| Total Biaya | $0.104 | $0.603 |
| Harga input | $0.300 / 1M | $0.450 / 1M |
| Harga output | $1.200 / 1M | $2.250 / 1M |
| Total token input | 276,199 | 292,271 |
| Token output | 17,473 | 55,025 |
| Token penalaran | 0 | 186,071 |
| Waktu respons (rata-rata) | 8.50s | 125.76s |
| Waktu respons (maks) | 81.77s | 566.79s |
| Waktu respons (total) | 195.60s | 2137.84s |
| Parameter | 1.6T total (48B aktif) | 1T total (32B aktif) |
| Ketersediaan | Sumber terbuka | Bobot tersedia |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#212 LongCat 2.0
none- Biaya
- $0.027
- Waktu
- 411.7s
- Token
- 22,283 tok
#206 MoonshotAI: Kimi K2.5
medium- Biaya
- $0.030
- Waktu
- 58.6s
- Token
- 8,683 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.1 | 3.1 | 66.7% | 1 | 81.77s | 167,447 | 8,098 | 0 | |
| Kimi K2.5 | 3.9 | 9.6 | 0.0% | 0 | 566.79s | 173,775 | 1,503 | 18,651 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.8 | 10.0 | 25.0% | 0 | 2.87s | 624 | 503 | 0 | |
| Kimi K2.5 | 7.3 | 5.8 | 83.3% | 2 | 51.38s | 634 | 2,789 | 8,880 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.5 | 10.0 | 33.3% | 0 | 2.85s | 7,446 | 578 | 0 | |
| Kimi K2.5 | 6.1 | 4.6 | 66.7% | 2 | 217.49s | 6,935 | 5,705 | 74,693 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 28.45s | 83,372 | 7,289 | 0 | |
| Kimi K2.5 | 6.7 | 9.1 | 50.0% | 0 | 89.19s | 95,416 | 14,448 | 11,209 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 2.36s | 7,671 | 246 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 49.78s | 7,020 | 563 | 7,940 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.3 | 10.0 | 33.3% | 0 | 1.68s | 738 | 28 | 0 | |
| Kimi K2.5 | 2.9 | 4.4 | 22.2% | 2 | 111.65s | 533 | 12,151 | 32,741 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.0 | 10.0 | 0.0% | 0 | 2.76s | 489 | 111 | 0 | |
| Kimi K2.5 | 6.5 | 3.4 | 66.7% | 1 | 69.73s | 480 | 3,815 | 4,262 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 2.82s | 675 | 66 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 92.47s | 675 | 5,371 | 6,547 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 4.0 | 5.0 | 33.3% | 2 | 2.74s | 663 | 299 | 0 | |
| Kimi K2.5 | 5.3 | 7.3 | 44.4% | 1 | 43.23s | 659 | 8,426 | 12,692 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 6.64s | 6,867 | 231 | 0 | |
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 31.74s | 5,933 | 242 | 812 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 3.92s | 207 | 24 | 0 | |
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 83.95s | 211 | 12 | 7,644 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
LongCat 2.0nonevsQwen3.5-35B-A3BmediumGemini 3.5 FlashminimalvsKimi K2.5mediumDots 3 Note PreviewlowTersedia gratisvsLongCat 2.0noneDots 3 Note PreviewhighTersedia gratisvsLongCat 2.0noneGemini 3.5 Flash LitelowvsLongCat 2.0noneGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0noneLongCat 2.0nonevsMiMo-V2.5-PromediumDots 3 Note PreviewhighTersedia gratisvsKimi K2.5mediumDots 3 Note PreviewlowTersedia gratisvsKimi K2.5mediumGemini 3.5 FlashminimalvsLongCat 2.0noneMercury 2.5mediumvsLongCat 2.0noneKimi K2.5mediumvsQwen3.5 Plus 2026-02-15none