Navigasi
Advertise here

MiniMax M2.5 (medium) vs GLM 5.3 Flash (max)

GLM 5.3 Flash (max) unggul dalam skor rata-rata dengan 9.0 vs 4.3. GLM 5.3 Flash (max) memiliki biaya benchmark lebih rendah di $0.089 vs $0.440. GLM 5.3 Flash (max) lebih cepat di 54.04s vs 102.32s, dengan tingkat keberhasilan 42.0% vs 82.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#348
Total token output
290,496
Waktu respons (rata-rata)
102.32s
Total Biaya
$0.440
Peringkat
#44
Total token output
216,119
Waktu respons (rata-rata)
54.04s
Total Biaya
$0.089
Model yang direkomendasikan GLM 5.3 Flash (max)

It has the best score here (9.0), while costing about 5.0x less than MiniMax M2.5 (medium).

Perbandingan terperinci

Metrik MiniMax M2.5 MiniMax M2.5 medium Rilis: 2026-02-12 GLM 5.3 Flash GLM 5.3 Flash max Rilis: 2026-08-26
Skor 4.3 9.0
Peringkat #348 #44
Keandalan 9.3 10.0
Konsistensi 6.8 9.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 42.0% 82.6%
Tes tidak stabil 9 3
Total Run 69 69
Biaya per hasil 7.104 0.519
Total Biaya $0.440 $0.089
Harga input $0.270 / 1M $0.150 / 1M
Harga output $1.080 / 1M $0.500 / 1M
Harga baca cache $0.027 / 1M $0.030 / 1M
Harga tulis cache T/A T/A
Total token input 188,239 255,743
Token output 27,822 8,684
Token penalaran 262,674 207,435
Waktu respons (rata-rata) 102.32s 54.04s
Waktu respons (maks) 600.81s 333.47s
Waktu respons (total) 1637.05s 1242.97s
Parameter 230B total (10B aktif) 320B total (18B aktif)
Ketersediaan Bobot tersedia Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#348 MiniMax M2.5

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Biaya
$0.000
Waktu
300.0s
Token
0 tok

#44 GLM 5.3 Flash

max
Biaya
$0.005
Waktu
296.5s
Token
16,250 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
GLM 5.3 Flash 10.0 10.0 100.0% 0 43.37s 7,317 381 23,692

Perbandingan Cepat

Ganti Pasangan Perbandingan