Navigasi
Advertise here

Qwen3.8 Flash Next (xhigh) vs MiMo-V2.5 (medium)

Skor rata-rata hampir imbang di 7.1 vs 7.1. MiMo-V2.5 (medium) memiliki biaya benchmark lebih rendah di $0.130 vs ~$0.195. MiMo-V2.5 (medium) lebih cepat di 49.20s vs 102.66s, dengan tingkat keberhasilan 72.5% vs 69.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-05

Model yang Dibandingkan

Peringkat
#154
Total token output
621,056
Waktu respons (rata-rata)
102.66s
Total Biaya
~$0.195
Peringkat
#157
Total token output
341,511
Waktu respons (rata-rata)
49.20s
Total Biaya
$0.130
Model yang direkomendasikan MiMo-V2.5 (medium)

It has the best score here (7.1), while costing about 1.5x less than Qwen3.8 Flash Next (xhigh).

Perbandingan terperinci

Metrik Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Rilis: 2026-10-04 MiMo-V2.5 MiMo-V2.5 medium Rilis: 2026-04-22
Skor 7.1 7.1
Peringkat #154 #157
Keandalan 9.9 10.0
Konsistensi 7.9 7.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 72.5% 69.6%
Tes tidak stabil 6 7
Total Run 69 69
Biaya per hasil ~1.390 3.491
Total Biaya ~$0.195 $0.130
Harga input T/A $0.140 / 1M
Harga output T/A $0.280 / 1M
Harga baca cache T/A $0.003 / 1M
Harga tulis cache T/A T/A
Total token input 301,749 259,664
Token output 1,033 8,414
Token penalaran 620,023 333,097
Waktu respons (rata-rata) 102.66s 49.20s
Waktu respons (maks) 674.08s 316.27s
Waktu respons (total) 2361.10s 1131.69s
Parameter 180B total (6B aktif) 310B total (15B aktif)
Ketersediaan Bobot tersedia Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 Qwen3.8 Flash Next

xhigh
Biaya
~$0.010
Waktu
333.1s
Token
30,654 tok

#157 MiMo-V2.5

medium
Biaya
$0.002
Waktu
54.8s
Token
5,247 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

Perbandingan Cepat

Ganti Pasangan Perbandingan

Qwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumGPT-5.2 ChatnonevsMiMo-V2.5mediumQwen3.8 Flash NextxhighvsMiMo-V2.6-FlashlowClaude Opus 5nonevsQwen3.8 Flash NextxhighQwen3.8 Flash NextxhighvsStep 3.7 FlashlowQwen3.8 Flash NextxhighvsGLM 5mediumLongCat 2.0mediumvsQwen3.8 Flash NextxhighEmber-1lowvsMiMo-V2.5mediumGPT-5.2 ChatnonevsQwen3.8 Flash NextxhighClaude Opus 5nonevsMiMo-V2.5mediumClaude Opus 4.8lowvsQwen3.8 Flash NextxhighGemini 3.1 Flash Lite PreviewmediumvsQwen3.8 Flash Nextxhigh