Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.6 (medium) vs Qwen3.7 Plus

Qwen3.7 Plus unggul dalam skor rata-rata dengan 7.3 vs 7.2. Qwen3.7 Plus memiliki biaya benchmark lebih rendah di $0.106 vs $1.247. Qwen3.7 Plus lebih cepat di 12.11s vs 115.89s, dengan tingkat keberhasilan 63.6% vs 54.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-29

Peringkat
#107
Total token output
347,519
Waktu respons (rata-rata)
115.89s
Total Biaya
$1.247
Peringkat
#104
Total token output
58,097
Waktu respons (rata-rata)
12.11s
Total Biaya
$0.106
Model yang direkomendasikan Qwen3.7 Plus

It has the best score here (7.3), while costing about 11.8x less than Kimi K2.6 (medium).

Perbandingan terperinci

Metrik Kimi K2.6 Kimi K2.6 medium Rilis: 2026-04-20 Qwen3.7 Plus Qwen3.7 Plus none Rilis: 2026-06-03
Skor 7.2 7.3
Peringkat #107 #104
Keandalan 10.0 10.0
Konsistensi 8.3 10.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 63.6% 54.6%
Tes tidak stabil 4 0
Total Run 66 66
Biaya per hasil 10.029 0.930
Total Biaya $1.247 $0.106
Harga input $0.950 / 1M $0.320 / 1M
Harga output $4.000 / 1M $1.280 / 1M
Total token input 68,913 98,833
Token output 64,654 58,097
Token penalaran 282,865 0
Waktu respons (rata-rata) 115.89s 12.11s
Waktu respons (maks) 876.20s 206.03s
Waktu respons (total) 2433.66s 266.40s
Parameter 1T total (32B aktif) ~397B total (~17B aktif)
Ketersediaan Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 MoonshotAI: Kimi K2.6

medium
Biaya
$0.013
Waktu
103.4s
Token
3,620 tok

#104 Qwen3.7 Plus

none
Biaya
$0.019
Waktu
213.5s
Token
11,960 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

Perbandingan Cepat

Ganti Pasangan Perbandingan