Navigasi
Advertise here

Command A+ (low) vs Tev1 4B Experimental

Command A+ (low) unggul dalam skor rata-rata dengan 3.0 vs 1.0. Tev1 4B Experimental memiliki biaya benchmark lebih rendah di $0.002 vs $0.073. Tev1 4B Experimental lebih cepat di 498ms vs 92.50s, dengan tingkat keberhasilan 1.5% vs 13.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#372
Total token output
25,521
Waktu respons (rata-rata)
92.50s
Total Biaya
$0.073
Peringkat
#381
Total token output
96
Waktu respons (rata-rata)
498ms
Total Biaya
$0.002
Model yang direkomendasikan Command A+ (low)

It has the strongest score in this comparison (3.0) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik Command A+ Command A+ low Rilis: 2026-09-23 Tev1 4B Experimental Tev1 4B Experimental none Rilis: 2026-09-30
Skor 3.0 1.0
Peringkat #372 #381
Keandalan 3.5 10.0
Konsistensi 9.6 3.0
Percobaan 69/69 21/69
Tes benar
Tingkat lulus per percobaan 1.5% 13.0%
Tes tidak stabil 1 0
Total Run 69 21
Biaya per hasil 0.000 0.048
Total Biaya $0.073 $0.002
Harga input $0.300 / 1M $0.042 / 1M
Harga output $1.500 / 1M $0.000 / 1M
Harga baca cache $0.150 / 1M T/A
Harga tulis cache T/A T/A
Total token input 114,874 33,864
Token output 1,992 96
Token penalaran 23,529 0
Waktu respons (rata-rata) 92.50s 498ms
Waktu respons (maks) 128.54s 602ms
Waktu respons (total) 2127.40s 3.49s
Parameter 218B total (25B aktif) 4B
Ketersediaan Sumber terbuka Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#372 Command A+

low
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#381 Together: Tev1 4B Experimental

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Command A+ 3.0 10.0 0.0% 0 86.43s 0 0 0
Tev1 4B Experimental 0.0 0.0 0.0% 0 0ms 0 0 0

Perbandingan Cepat

Ganti Pasangan Perbandingan