Navigasi
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (high) vs Qwen3.5-122B-A10B (medium)

KAT-Coder-Pro V2.5 (high) unggul dalam skor rata-rata dengan 7.2 vs 7.1. KAT-Coder-Pro V2.5 (high) memiliki biaya benchmark lebih rendah di $0.506 vs $1.047. KAT-Coder-Pro V2.5 (high) lebih cepat di 22.11s vs 65.67s, dengan tingkat keberhasilan 63.6% vs 71.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-26

Peringkat
#108
Total token output
144,359
Waktu respons (rata-rata)
22.11s
Total Biaya
$0.506
Peringkat
#113
Total token output
487,519
Waktu respons (rata-rata)
65.67s
Total Biaya
$1.047
Model yang direkomendasikan KAT-Coder-Pro V2.5 (high)

It has the best score here (7.2), while costing about 2.1x less than Qwen3.5-122B-A10B (medium).

Perbandingan terperinci

Metrik KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 high Rilis: 2026-07-14 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Rilis: 2026-02-24
Skor 7.2 7.1
Peringkat #108 #113
Keandalan 10.0 10.0
Konsistensi 7.8 8.5
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 63.6% 71.2%
Tes tidak stabil 6 4
Total Run 66 66
Biaya per hasil 4.599 8.446
Total Biaya $0.506 $1.047
Harga input $0.740 / 1M $0.260 / 1M
Harga output $2.960 / 1M $2.080 / 1M
Total token input 106,085 124,780
Token output 9,071 47,694
Token penalaran 135,288 439,825
Waktu respons (rata-rata) 22.11s 65.67s
Waktu respons (maks) 199.97s 519.30s
Waktu respons (total) 486.31s 1444.68s
Parameter ~700B total (~72B aktif) 122B total (10B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 KAT-Coder-Pro V2.5

high
Biaya
$0.009
Waktu
26.4s
Token
3,117 tok

#113 Qwen3.5-122B-A10B

medium
Biaya
$0.019
Waktu
48.7s
Token
6,034 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
KAT-Coder-Pro V2.5 6.4 7.9 44.4% 1 22.00s 7,893 422 20,461
Qwen3.5-122B-A10B 6.0 7.2 55.6% 1 114.48s 7,630 8,057 82,578

Perbandingan Cepat

Ganti Pasangan Perbandingan