Navigasi
Advertise here

Kev 4B (default) vs Grok 4.20

Grok 4.20 unggul dalam skor rata-rata dengan 3.4 vs 2.4. Kev 4B (default) memiliki biaya benchmark lebih rendah di $0.002 vs $0.057. Grok 4.20 lebih cepat di 1.11s vs 5.63s, dengan tingkat keberhasilan 15.9% vs 26.1%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#391
Total token output
28,061
Waktu respons (rata-rata)
5.63s
Total Biaya
$0.002
Peringkat
#376
Total token output
1,923
Waktu respons (rata-rata)
1.11s
Total Biaya
$0.057
Model yang direkomendasikan Grok 4.20

It has the best score here (3.4), while responding about 5.1x faster than Kev 4B (default).

Perbandingan terperinci

Metrik Kev 4B Kev 4B default Rilis: 2026-09-28 Grok 4.20 Grok 4.20 none Rilis: 2026-03-31
Skor 2.4 3.4
Peringkat #391 #376
Keandalan 10.0 T/A
Konsistensi 4.9 7.8
Percobaan 36/69 54/69
Tes benar
Tingkat lulus per percobaan 15.9% 26.1%
Tes tidak stabil 1 0
Total Run 36 54
Biaya per hasil 0.060 1.570
Total Biaya $0.002 $0.057
Harga input $0.042 / 1M $1.250 / 1M
Harga output $0.000 / 1M $2.500 / 1M
Harga baca cache T/A $0.200 / 1M
Harga tulis cache T/A T/A
Total token input 42,804 41,313
Token output 28,061 1,923
Token penalaran 0 0
Waktu respons (rata-rata) 5.63s 1.11s
Waktu respons (maks) 17.79s 6.04s
Waktu respons (total) 67.61s 19.96s
Parameter 4B ~1T total (~100B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#391 Jared Palmer: Kev 4B

default
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

#376 xAI: Grok 4.20

none
Biaya
$0.004
Waktu
6.5s
Token
1,367 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

Perbandingan Cepat

Ganti Pasangan Perbandingan

Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultQwen3.5-9BmediumvsGrok 4.20none