Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.6 Plus (medium) vs Qwen3.7 Plus (medium)

Skor rata-rata hampir imbang di 7.8 vs 7.9. Qwen3.7 Plus (medium) memiliki biaya benchmark lebih rendah di $0.277 vs $0.418. Qwen3.6 Plus (medium) lebih cepat di 45.52s vs 53.51s, dengan tingkat keberhasilan 71.2% vs 75.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-02

Peringkat
#66
Total token output
197,632
Waktu respons (rata-rata)
45.52s
Total Biaya
$0.418
Peringkat
#65
Total token output
187,337
Waktu respons (rata-rata)
53.51s
Total Biaya
$0.277
Model yang direkomendasikan Qwen3.7 Plus (medium)

It has the best score here (7.9), while costing about 1.5x less than Qwen3.6 Plus (medium).

Perbandingan terperinci

Metrik Qwen3.6 Plus Qwen3.6 Plus medium Rilis: 2026-04-20 Qwen3.7 Plus Qwen3.7 Plus medium Rilis: 2026-06-03
Skor 7.8 7.9
Peringkat #66 #65
Keandalan 10.0 10.0
Konsistensi 9.3 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 71.2% 75.8%
Tes tidak stabil 2 3
Total Run 66 66
Biaya per hasil 1.695 2.134
Total Biaya $0.418 $0.277
Harga input $0.325 / 1M $0.320 / 1M
Harga output $1.950 / 1M $1.280 / 1M
Total token input 97,698 115,242
Token output 6,417 6,163
Token penalaran 191,215 181,174
Waktu respons (rata-rata) 45.52s 53.51s
Waktu respons (maks) 291.55s 315.30s
Waktu respons (total) 955.94s 1177.25s
Parameter ~397B total (~17B aktif) ~397B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Qwen3.6 Plus

medium
Biaya
$0.024
Waktu
219.0s
Token
12,235 tok

#65 Qwen3.7 Plus

medium
Biaya
$0.018
Waktu
193.2s
Token
10,821 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576

Perbandingan Cepat

Ganti Pasangan Perbandingan