Navigasi
Advertise here

MiniMax M2.5 (medium) vs GLM 4.7 Flash (medium)

MiniMax M2.5 (medium) unggul dalam skor rata-rata dengan 4.3 vs 4.2. GLM 4.7 Flash (medium) memiliki biaya benchmark lebih rendah di $0.193 vs $0.440. MiniMax M2.5 (medium) lebih cepat di 102.32s vs 150.90s, dengan tingkat keberhasilan 42.0% vs 30.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#348
Total token output
290,496
Waktu respons (rata-rata)
102.32s
Total Biaya
$0.440
Peringkat
#349
Total token output
464,375
Waktu respons (rata-rata)
150.90s
Total Biaya
$0.193
Model yang direkomendasikan GLM 4.7 Flash (medium)

Its score stays close to the best score here (4.2 vs 4.3), while costing about 2.3x less than MiniMax M2.5 (medium).

Perbandingan terperinci

Metrik MiniMax M2.5 MiniMax M2.5 medium Rilis: 2026-02-12 GLM 4.7 Flash GLM 4.7 Flash medium Rilis: 2026-01-19
Skor 4.3 4.2
Peringkat #348 #349
Keandalan 9.3 9.4
Konsistensi 6.8 7.1
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 42.0% 30.4%
Tes tidak stabil 9 8
Total Run 69 69
Biaya per hasil 7.104 4.822
Total Biaya $0.440 $0.193
Harga input $0.270 / 1M $0.061 / 1M
Harga output $1.080 / 1M $0.400 / 1M
Harga baca cache $0.027 / 1M T/A
Harga tulis cache T/A T/A
Total token input 188,239 228,711
Token output 27,822 42,254
Token penalaran 262,674 422,121
Waktu respons (rata-rata) 102.32s 150.90s
Waktu respons (maks) 600.81s 1539.97s
Waktu respons (total) 1637.05s 2414.33s
Parameter 230B total (10B aktif) 30B total (3B aktif)
Ketersediaan Bobot tersedia Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#348 MiniMax M2.5

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Biaya
$0.000
Waktu
300.0s
Token
0 tok

#349 GLM 4.7 Flash

medium
No output was saved. The original provider response or failure reason is unavailable.
Biaya
$0.000
Waktu
186.2s
Token
12,112 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
GLM 4.7 Flash 3.2 7.4 11.1% 1 55.33s 3,106 4,981 22,387

Perbandingan Cepat

Ganti Pasangan Perbandingan