Navigasi
Advertise here

Kimi K2.7 Code (medium) vs GPT-5.6 Luna (medium)

Skor rata-rata hampir imbang di 7.4 vs 7.4. GPT-5.6 Luna (medium) memiliki biaya benchmark lebih rendah di $0.072 vs $0.709. GPT-5.6 Luna (medium) lebih cepat di 7.43s vs 80.09s, dengan tingkat keberhasilan 63.6% vs 62.1%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-10

Model yang Dibandingkan

Peringkat
#114
Total token output
239,546
Waktu respons (rata-rata)
80.09s
Total Biaya
$0.709
Peringkat
#115
Total token output
44,525
Waktu respons (rata-rata)
7.43s
Total Biaya
$0.072
Model yang direkomendasikan GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 9.9x less than Kimi K2.7 Code (medium).

Perbandingan terperinci

Metrik Kimi K2.7 Code Kimi K2.7 Code medium Rilis: 2026-06-12 GPT-5.6 Luna GPT-5.6 Luna medium Rilis: 2026-07-09
Skor 7.4 7.4
Peringkat #114 #115
Keandalan 10.0 10.0
Konsistensi 8.0 9.2
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 63.6% 62.1%
Tes tidak stabil 5 2
Total Run 66 66
Biaya per hasil 7.096 2.601
Total Biaya $0.709 $0.072
Harga input $0.710 / 1M $0.200 / 1M
Harga output $3.500 / 1M $1.200 / 1M
Total token input 72,085 89,685
Token output 57,453 5,701
Token penalaran 182,093 38,824
Waktu respons (rata-rata) 80.09s 7.43s
Waktu respons (maks) 365.80s 29.85s
Waktu respons (total) 1681.85s 163.54s
Parameter 1T total (32B aktif) ~400B total (~17B aktif)
Ketersediaan Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 MoonshotAI: Kimi K2.7 Code

medium
Biaya
$0.025
Waktu
138.0s
Token
6,093 tok

#115 GPT-5.6 Luna

medium
Biaya
$0.014
Waktu
14.6s
Token
2,362 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

Perbandingan Cepat

Ganti Pasangan Perbandingan