- Peringkat
- #206
- Total token output
- 241,096
- Waktu respons (rata-rata)
- 125.76s
- Total Biaya
- $0.603
Kimi K2.5 (medium) vs Qwen3.5-122B-A10B
Skor rata-rata hampir imbang di 6.4 vs 6.4. Qwen3.5-122B-A10B memiliki biaya benchmark lebih rendah di $0.308 vs $0.603. Qwen3.5-122B-A10B lebih cepat di 14.79s vs 125.76s, dengan tingkat keberhasilan 60.9% vs 36.2%.
Model yang Dibandingkan
- Peringkat
- #201
- Total token output
- 97,112
- Waktu respons (rata-rata)
- 14.79s
- Total Biaya
- $0.308
Model yang direkomendasikan
Qwen3.5-122B-A10B
It has the best score here (6.4), while costing about 2.0x less than Kimi K2.5 (medium).
Perbandingan terperinci
| Metrik | Kimi K2.5 Kimi K2.5 medium | Qwen3.5-122B-A10B Qwen3.5-122B-A10B none |
|---|---|---|
| Skor | 6.4 | 6.4 |
| Peringkat | #206 | #201 |
| Keandalan | 9.6 | 10.0 |
| Konsistensi | 7.1 | 9.3 |
| Percobaan | 69/69 | 69/69 |
| Tes benar | ||
| Tingkat lulus per percobaan | 60.9% | 36.2% |
| Tes tidak stabil | 8 | 2 |
| Total Run | 69 | 69 |
| Biaya per hasil | 6.085 | 4.452 |
| Total Biaya | $0.603 | $0.308 |
| Harga input | $0.450 / 1M | $0.260 / 1M |
| Harga output | $2.250 / 1M | $2.080 / 1M |
| Total token input | 292,271 | 405,921 |
| Token output | 55,025 | 97,112 |
| Token penalaran | 186,071 | 0 |
| Waktu respons (rata-rata) | 125.76s | 14.79s |
| Waktu respons (maks) | 566.79s | 212.63s |
| Waktu respons (total) | 2137.84s | 340.25s |
| Parameter | 1T total (32B aktif) | 122B total (10B aktif) |
| Ketersediaan | Bobot tersedia | Sumber terbuka |
Showcase generasi model
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#206 MoonshotAI: Kimi K2.5
medium- Biaya
- $0.030
- Waktu
- 58.6s
- Token
- 8,683 tok
#201 Qwen3.5-122B-A10B
none- Biaya
- $0.016
- Waktu
- 44.5s
- Token
- 6,431 tok
Model teratas berdasarkan skor
Skor vs Total Biaya
Waktu respons (rata-rata)
Skor vs Waktu respons (rata-rata)
Total token output
Skor vs Total token output
Rincian Kategori
| Tugas agen | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 3.9 | 9.6 | 0.0% | 0 | 566.79s | 173,775 | 1,503 | 18,651 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 55.86s | 164,346 | 8,653 | 0 |
| Trik anti-AI | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 7.3 | 5.8 | 83.3% | 2 | 51.38s | 634 | 2,789 | 8,880 | |
| Qwen3.5-122B-A10B | 4.8 | 10.0 | 25.0% | 0 | 1.59s | 696 | 312 | 0 |
| Pemrograman | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.1 | 4.6 | 66.7% | 2 | 217.49s | 6,935 | 5,705 | 74,693 | |
| Qwen3.5-122B-A10B | 3.7 | 7.0 | 22.2% | 1 | 2.77s | 7,913 | 693 | 0 |
| Gabungan | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.7 | 9.1 | 50.0% | 0 | 89.19s | 95,416 | 14,448 | 11,209 | |
| Qwen3.5-122B-A10B | 5.2 | 6.9 | 33.3% | 1 | 129.31s | 214,006 | 86,212 | 0 |
| Parsing dan ekstraksi data | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 49.78s | 7,020 | 563 | 7,940 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 1.01s | 7,794 | 243 | 0 |
| Spesifik domain | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 2.9 | 4.4 | 22.2% | 2 | 111.65s | 533 | 12,151 | 32,741 | |
| Qwen3.5-122B-A10B | 5.3 | 10.0 | 33.3% | 0 | 523ms | 798 | 16 | 0 |
| Kecerdasan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 6.5 | 3.4 | 66.7% | 1 | 69.73s | 480 | 3,815 | 4,262 | |
| Qwen3.5-122B-A10B | 5.0 | 10.0 | 0.0% | 0 | 1.12s | 522 | 66 | 0 |
| Kepatuhan instruksi | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 92.47s | 675 | 5,371 | 6,547 | |
| Qwen3.5-122B-A10B | 6.3 | 10.0 | 50.0% | 0 | 513ms | 711 | 69 | 0 |
| Pemecahan teka-teki | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 5.3 | 7.3 | 44.4% | 1 | 43.23s | 659 | 8,426 | 12,692 | |
| Qwen3.5-122B-A10B | 3.8 | 10.0 | 0.0% | 0 | 1.00s | 714 | 575 | 0 |
| Pemanggilan alat | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 10.0 | 10.0 | 100.0% | 0 | 31.74s | 5,933 | 242 | 812 | |
| Qwen3.5-122B-A10B | 10.0 | 10.0 | 100.0% | 0 | 2.04s | 8,211 | 264 | 0 |
| Pengetahuan umum | Skor | Konsistensi | Tingkat lulus per percobaan | Tes tidak stabil | Tes benar | Waktu respons (rata-rata) | Token input | Token output | Token penalaran |
|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 | 3.0 | 10.0 | 0.0% | 0 | 83.95s | 211 | 12 | 7,644 | |
| Qwen3.5-122B-A10B | 3.0 | 10.0 | 0.0% | 0 | 295ms | 210 | 9 | 0 |
Perbandingan Cepat
Ganti Pasangan Perbandingan
Laguna XS 2.1mediumTersedia gratisvsQwen3.5-122B-A10BnoneGemini 3.5 FlashminimalvsKimi K2.5mediumQwen3.5-122B-A10BnonevsGrok 4.3mediumKAT-Coder-Pro V2.5highvsQwen3.5-122B-A10BnoneQwen3.5-122B-A10BnonevsSolar Pro 4mediumDots 3 Note PreviewhighTersedia gratisvsKimi K2.5mediumDots 3 Note PreviewlowTersedia gratisvsKimi K2.5mediumKimi K2.5mediumvsQwen3.5 Plus 2026-02-15noneQwen3.5-122B-A10BnonevsGLM 5.3lowGemini 3 Flash PreviewnonevsKimi K2.5mediumMercury 2.5highvsQwen3.5-122B-A10BnoneLongCat 2.0nonevsKimi K2.5medium