Navigasi
Advertise here

Kimi K2.7 Code (medium) vs Grok Build 0.1 (medium)

Skor rata-rata hampir imbang di 7.4 vs 7.5. Kimi K2.7 Code (medium) memiliki biaya benchmark lebih rendah di $0.709 vs $1.130. Grok Build 0.1 (medium) lebih cepat di 54.50s vs 80.09s, dengan tingkat keberhasilan 63.6% vs 60.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-10

Model yang Dibandingkan

Peringkat
#114
Total token output
239,546
Waktu respons (rata-rata)
80.09s
Total Biaya
$0.709
Peringkat
#110
Total token output
511,406
Waktu respons (rata-rata)
54.50s
Total Biaya
$1.130
Model yang direkomendasikan Kimi K2.7 Code (medium)

It has the best score here (7.4), while costing about 1.6x less than Grok Build 0.1 (medium).

Perbandingan terperinci

Metrik Kimi K2.7 Code Kimi K2.7 Code medium Rilis: 2026-06-12 Grok Build 0.1 Grok Build 0.1 medium Rilis: 2026-05-21
Skor 7.4 7.5
Peringkat #114 #110
Keandalan 10.0 10.0
Konsistensi 8.0 9.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 63.6% 60.6%
Tes tidak stabil 5 1
Total Run 66 66
Biaya per hasil 7.096 8.691
Total Biaya $0.709 $1.130
Harga input $0.710 / 1M $1.000 / 1M
Harga output $3.500 / 1M $2.000 / 1M
Total token input 72,085 106,946
Token output 57,453 7,993
Token penalaran 182,093 503,413
Waktu respons (rata-rata) 80.09s 54.50s
Waktu respons (maks) 365.80s 252.69s
Waktu respons (total) 1681.85s 1199.07s
Parameter 1T total (32B aktif) ~300B total (~30B aktif)
Ketersediaan Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 MoonshotAI: Kimi K2.7 Code

medium
Biaya
$0.025
Waktu
138.0s
Token
6,093 tok

#110 SpaceXAI: Grok Build 0.1

medium
Biaya
$0.028
Waktu
81.3s
Token
14,009 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

Perbandingan Cepat

Ganti Pasangan Perbandingan