Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Command A+ (low) vs Decider V1.1 27B (default)

Command A+ (low) unggul dalam skor rata-rata dengan 3.0 vs 2.6. Decider V1.1 27B (default) memiliki biaya benchmark lebih rendah di $0.002 vs $0.073. Decider V1.1 27B (default) lebih cepat di 320ms vs 92.50s, dengan tingkat keberhasilan 1.5% vs 17.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#391
Total token output
25,521
Waktu respons (rata-rata)
92.50s
Total Biaya
$0.073
Peringkat
#395
Total token output
69
Waktu respons (rata-rata)
320ms
Total Biaya
$0.002
Model yang direkomendasikan Decider V1.1 27B (default)

Its score stays close to the best score here (2.6 vs 3.0), while costing about 49.4x less than Command A+ (low).

Perbandingan terperinci

Metrik Command A+ Command A+ low Rilis: 2026-09-23 Decider V1.1 27B Decider V1.1 27B default Rilis: 2026-10-07
Skor 3.0 2.6
Peringkat #391 #395
Keandalan 3.5 10.0
Konsistensi 9.6 5.2
Percobaan 69/69 36/69
Tes benar
Tingkat lulus per percobaan 1.5% 17.4%
Tes tidak stabil 1 0
Total Run 69 36
Biaya per hasil 0.000 0.037
Total Biaya $0.073 $0.002
Harga input $0.300 / 1M $0.020 / 1M
Harga output $1.500 / 1M $0.000 / 1M
Harga baca cache $0.150 / 1M T/A
Harga tulis cache T/A T/A
Total token input 114,874 73,557
Token output 1,992 69
Token penalaran 23,529 0
Waktu respons (rata-rata) 92.50s 320ms
Waktu respons (maks) 128.54s 491ms
Waktu respons (total) 2127.40s 3.84s
Parameter 218B total (25B aktif) 27B
Ketersediaan Sumber terbuka Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#391 Command A+

low
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#395 Decider V1.1 27B

default
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Command A+ 3.0 10.0 0.0% 0 86.43s 0 0 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Ganti Pasangan Perbandingan

Command A+lowvsJev 1.13defaultCommand A+lowvsGrok 4.20noneCommand A+nonevsDecider V1.1 27BdefaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+lowvsKev 4BdefaultCommand A+highvsDecider V1.1 27BdefaultCommand A+lowvsLing 3.0 TinymediumCommand A+lowvsLing 3.0 TinyhighGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20noneCommand A+lowvsNemotron 3.5 LightningnoneTersedia gratis