Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kev 4B (default) vs Decider V1.1 27B (default)

Decider V1.1 27B (default) unggul dalam skor rata-rata dengan 2.6 vs 2.4. Decider V1.1 27B (default) memiliki biaya benchmark lebih rendah di $0.002 vs $0.002. Decider V1.1 27B (default) lebih cepat di 320ms vs 5.63s, dengan tingkat keberhasilan 15.9% vs 17.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#397
Total token output
28,061
Waktu respons (rata-rata)
5.63s
Total Biaya
$0.002
Peringkat
#395
Total token output
69
Waktu respons (rata-rata)
320ms
Total Biaya
$0.002
Model yang direkomendasikan Decider V1.1 27B (default)

It has the best score here (2.6), while responding about 17.6x faster than Kev 4B (default).

Perbandingan terperinci

Metrik Kev 4B Kev 4B default Rilis: 2026-09-28 Decider V1.1 27B Decider V1.1 27B default Rilis: 2026-10-07
Skor 2.4 2.6
Peringkat #397 #395
Keandalan 10.0 10.0
Konsistensi 4.9 5.2
Percobaan 36/69 36/69
Tes benar
Tingkat lulus per percobaan 15.9% 17.4%
Tes tidak stabil 1 0
Total Run 36 36
Biaya per hasil 0.060 0.037
Total Biaya $0.002 $0.002
Harga input $0.042 / 1M $0.020 / 1M
Harga output $0.000 / 1M $0.000 / 1M
Harga baca cache T/A T/A
Harga tulis cache T/A T/A
Total token input 42,804 73,557
Token output 28,061 69
Token penalaran 0 0
Waktu respons (rata-rata) 5.63s 320ms
Waktu respons (maks) 17.79s 491ms
Waktu respons (total) 67.61s 3.84s
Parameter 4B 27B
Ketersediaan Sumber terbuka Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Ganti Pasangan Perbandingan

Command A+lowvsDecider V1.1 27BdefaultCommand A+nonevsDecider V1.1 27BdefaultCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultCommand A+highvsDecider V1.1 27BdefaultGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+highvsKev 4BdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20noneCommand A+mediumvsKev 4BdefaultKev 4BdefaultvsGrok 4.20none