Navigasi
Advertise here

Ling 3.1 Flash (high) vs Qwen3.8 2.4T A95B (high)

Skor rata-rata hampir imbang di 7.9 vs 7.9. Ling 3.1 Flash (high) memiliki biaya benchmark lebih rendah di $0.000 vs $2.949. Ling 3.1 Flash (high) lebih cepat di 87.39s vs 120.88s, dengan tingkat keberhasilan 69.6% vs 75.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#105
Total token output
687,692
Waktu respons (rata-rata)
87.39s
Total Biaya
$0.000
Peringkat
#103
Total token output
468,439
Waktu respons (rata-rata)
120.88s
Total Biaya
$2.949
Model yang direkomendasikan Qwen3.8 2.4T A95B (high)

It has the strongest score in this comparison (7.9) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik Ling 3.1 Flash Ling 3.1 Flash high Rilis: 2026-10-03 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high Rilis: 2026-08-12
Skor 7.9 7.9
Peringkat #105 #103
Keandalan 9.8 9.6
Konsistensi 9.3 8.4
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 69.6% 75.4%
Tes tidak stabil 2 4
Total Run 69 69
Biaya per hasil 0.000 18.696
Total Biaya $0.000 $2.949
Harga input $0.000 / 1M $2.000 / 1M
Harga output $0.000 / 1M $6.000 / 1M
Harga baca cache T/A $0.250 / 1M
Harga tulis cache T/A T/A
Total token input 324,691 295,642
Token output 181,251 115,041
Token penalaran 506,441 353,398
Waktu respons (rata-rata) 87.39s 120.88s
Waktu respons (maks) 665.85s 532.28s
Waktu respons (total) 2010.08s 2780.16s
Parameter 560B total (25B aktif) 2.4T total (95B aktif)
Ketersediaan Tertutup Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#105 Ling 3.1 Flash

high
Biaya
$0.000
Waktu
181.1s
Token
21,073 tok

#103 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Biaya
$0.000
Waktu
600.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ling 3.1 Flash 8.2 7.2 88.9% 1 83.41s 8,298 17,470 54,626
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078

Perbandingan Cepat

Ganti Pasangan Perbandingan