Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Pro V2.5 vs Qwen3.5-27B

KAT-Coder-Pro V2.5 unggul dalam skor rata-rata dengan 6.7 vs 6.6. Qwen3.5-27B memiliki biaya benchmark lebih rendah di $0.058 vs $0.487. Qwen3.5-27B lebih cepat di 4.77s vs 26.01s, dengan tingkat keberhasilan 71.2% vs 45.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-20

Peringkat
#139
Total token output
139,572
Waktu respons (rata-rata)
26.01s
Total Biaya
$0.487
Peringkat
#146
Total token output
24,323
Waktu respons (rata-rata)
4.77s
Total Biaya
$0.058
Model yang direkomendasikan Qwen3.5-27B

Its score stays close to the best score here (6.6 vs 6.7), while costing about 8.4x less than KAT-Coder-Pro V2.5.

Perbandingan terperinci

Metrik KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none Rilis: 2026-07-14 Qwen3.5-27B Qwen3.5-27B none Rilis: 2026-02-24
Skor 6.7 6.6
Peringkat #139 #146
Keandalan 10.0 10.0
Konsistensi 7.0 9.3
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 71.2% 45.5%
Tes tidak stabil 8 2
Total Run 66 66
Biaya per hasil 4.419 0.678
Total Biaya $0.487 $0.058
Harga input $0.740 / 1M $0.195 / 1M
Harga output $2.960 / 1M $1.560 / 1M
Total token input 98,508 102,325
Token output 139,572 24,323
Token penalaran 0 0
Waktu respons (rata-rata) 26.01s 4.77s
Waktu respons (maks) 335.41s 69.46s
Waktu respons (total) 572.22s 105.00s
Parameter ~700B total (~72B aktif) 27B
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 KAT-Coder-Pro V2.5

none
Biaya
$0.010
Waktu
29.0s
Token
3,439 tok

#146 Qwen3.5-27B

none
Biaya
$0.007
Waktu
42.9s
Token
4,273 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

Perbandingan Cepat

Ganti Pasangan Perbandingan