- Peringkat
- #160
- Total token output
- 386,642
- Waktu respons (rata-rata)
- 153.29s
- Total Biaya
- $0.492
LongCat 2.0 (high) vs Qwen3.6 35B A3B (medium)
LongCat 2.0 (high) unggul dalam skor rata-rata dengan 6.7 vs 6.6. LongCat 2.0 (high) memiliki biaya benchmark lebih rendah di $0.492 vs $0.672. Qwen3.6 35B A3B (medium) lebih cepat di 58.49s vs 153.29s, dengan tingkat keberhasilan 51.5% vs 57.6%.
- Peringkat
- #167
- Total token output
- 743,292
- Waktu respons (rata-rata)
- 58.49s
- Total Biaya
- $0.672
Model yang direkomendasikan
Qwen3.6 35B A3B (medium)
Its score stays close to the best score here (6.6 vs 6.7), while responding about 2.6x faster than LongCat 2.0 (high).
Perbandingan terperinci
| Metrik | LongCat 2.0 LongCat 2.0 high | Qwen3.6 35B A3B Qwen3.6 35B A3B medium |
|---|---|---|
| Skor | 6.7 | 6.6 |
| Peringkat | #160 | #167 |
| Keandalan | 10.0 | 10.0 |
| Konsistensi | 8.4 | 9.2 |
| Percobaan | 66/66 | 66/66 |
| Tes benar | ||
| Tingkat lulus per percobaan | 51.5% | 57.6% |
| Tes tidak stabil | 4 | 2 |
| Total Run | 66 | 66 |
| Biaya per hasil | 5.467 | 6.212 |
| Total Biaya | $0.492 | $0.672 |
| Harga input | $0.300 / 1M | $0.100 / 1M |
| Harga output | $1.200 / 1M | $0.900 / 1M |
| Total token input | 93,411 | 85,148 |
| Token output | 30,470 | 61,736 |
| Token penalaran | 356,172 | 681,556 |
| Waktu respons (rata-rata) | 153.29s | 58.49s |
| Waktu respons (maks) | 941.66s | 817.57s |
| Waktu respons (total) | 3372.36s | 1169.83s |
| Parameter | 1.6T total (48B aktif) | 35B total (3B aktif) |
| Ketersediaan | Sumber terbuka | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#160 LongCat 2.0
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Biaya
- $0.000
- Waktu
- 600.0s
- Token
- 0 tok
#167 Qwen3.6 35B A3B
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Biaya
- $0.000
- Waktu
- 300.0s
- Token
- 0 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 8.9 | 8.1 | 91.7% | 1 | 7.76s | 588 | 303 | 3,300 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 6.02s | 672 | 1,154 | 12,385 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.8 | 9.3 | 66.7% | 0 | 505.33s | 6,913 | 244 | 192,377 | |
| Qwen3.6 35B A3B | 7.7 | 10.0 | 66.7% | 0 | 50.55s | 5,051 | 7,929 | 37,223 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 167.13s | 68,941 | 4,934 | 49,558 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 817.57s | 68,754 | 42,187 | 548,547 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 5.8 | 33.3% | 1 | 10.98s | 7,653 | 197 | 2,714 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 12.99s | 7,776 | 2,591 | 9,968 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 7.2 | 22.2% | 1 | 433.73s | 505 | 23,928 | 86,947 | |
| Qwen3.6 35B A3B | 2.9 | 4.4 | 22.2% | 2 | 25.39s | 780 | 6,110 | 41,906 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.1 | 10.0 | 0.0% | 0 | 17.00s | 480 | 111 | 1,748 | |
| Qwen3.6 35B A3B | 4.4 | 9.9 | 0.0% | 0 | 8.66s | 516 | 129 | 4,569 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 6.96s | 657 | 78 | 1,726 | |
| Qwen3.6 35B A3B | 10.0 | 10.0 | 100.0% | 0 | 7.50s | 699 | 219 | 7,404 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.1 | 7.4 | 11.1% | 1 | 9.18s | 636 | 379 | 2,778 | |
| Qwen3.6 35B A3B | 8.0 | 10.0 | 66.7% | 0 | 5.95s | 696 | 655 | 9,228 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.02s | 6,840 | 249 | 505 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 99.44s | 198 | 47 | 14,519 | |
| Qwen3.6 35B A3B | 3.0 | 10.0 | 0.0% | 0 | 32.90s | 204 | 762 | 10,326 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Gemini 3.1 Flash LitelowvsQwen3.6 35B A3BmediumMercury 2.5 PreviewhighvsQwen3.6 35B A3BmediumGemini 3.5 FlashminimalvsLongCat 2.0highGemini 3.1 Flash Lite PreviewlowvsQwen3.6 35B A3BmediumGemini 3.5 Flash LitelowvsQwen3.6 35B A3BmediumGemini 3.5 Flash LitelowvsLongCat 2.0highLongCat 2.0highvsQwen3.5-27BnoneGemini 3.1 Flash Lite PreviewlowvsLongCat 2.0highKAT-Coder-Pro V2.5nonevsLongCat 2.0highLongCat 2.0highvsInkling SmallmediumGemini 3.1 Flash LitelowvsLongCat 2.0highLongCat 2.0highvsGLM 5.2none