Navigasi
Advertise here

Mistral Large 4 (medium) vs Qwen3.5 Plus 2026-04-20

Mistral Large 4 (medium) unggul dalam skor rata-rata dengan 6.2 vs 6.1. Qwen3.5 Plus 2026-04-20 memiliki biaya benchmark lebih rendah di $0.216 vs $1.456. Qwen3.5 Plus 2026-04-20 lebih cepat di 18.49s vs 265.03s, dengan tingkat keberhasilan 55.1% vs 44.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-06

Model yang Dibandingkan

Peringkat
#240
Total token output
627,233
Waktu respons (rata-rata)
265.03s
Total Biaya
$1.456
Peringkat
#245
Total token output
69,664
Waktu respons (rata-rata)
18.49s
Total Biaya
$0.216
Model yang direkomendasikan Qwen3.5 Plus 2026-04-20

Its score stays close to the best score here (6.1 vs 6.2), while costing about 6.8x less than Mistral Large 4 (medium).

Perbandingan terperinci

Metrik Mistral Large 4 Mistral Large 4 medium Rilis: 2026-10-06 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Rilis: 2026-04-20
Skor 6.2 6.1
Peringkat #240 #245
Keandalan 9.2 9.8
Konsistensi 7.6 8.4
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 55.1% 44.9%
Tes tidak stabil 7 5
Total Run 69 69
Biaya per hasil 16.168 2.816
Total Biaya $1.456 $0.216
Harga input $0.680 / 1M $0.300 / 1M
Harga output $2.090 / 1M $1.800 / 1M
Harga baca cache $0.070 / 1M T/A
Harga tulis cache T/A $0.375 / 1M
Total token input 212,024 299,984
Token output 166,422 69,664
Token penalaran 562,095 0
Waktu respons (rata-rata) 265.03s 18.49s
Waktu respons (maks) 1760.20s 206.05s
Waktu respons (total) 6095.69s 425.33s
Parameter 1.05T total (49B aktif) ~397B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#240 Mistral Large 4

medium
Biaya
$0.011
Waktu
63.4s
Token
5,291 tok

#245 Qwen3.5 Plus 2026-04-20

none
Biaya
$0.008
Waktu
77.0s
Token
4,369 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mistral Large 4 3.4 7.2 22.2% 1 1201.87s 7,189 33,530 303,140
Qwen3.5 Plus 2026-04-20 3.9 7.8 11.1% 1 1.69s 7,913 480 0

Perbandingan Cepat

Ganti Pasangan Perbandingan