Navigasi
Advertise here

Claude Haiku 5.5 (max) vs Qwen3.8 2.4T A95B (low)

Claude Haiku 5.5 (max) unggul dalam skor rata-rata dengan 8.5 vs 8.4. Claude Haiku 5.5 (max) memiliki biaya benchmark lebih rendah di $0.509 vs $4.016. Claude Haiku 5.5 (max) lebih cepat di 61.71s vs 120.40s, dengan tingkat keberhasilan 85.5% vs 73.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#70
Total token output
919,699
Waktu respons (rata-rata)
61.71s
Total Biaya
$0.509
Peringkat
#71
Total token output
424,019
Waktu respons (rata-rata)
120.40s
Total Biaya
$4.016
Model yang direkomendasikan Claude Haiku 5.5 (max)

It has the best score here (8.5), while costing about 7.9x less than Qwen3.8 2.4T A95B (low).

Perbandingan terperinci

Metrik Claude Haiku 5.5 Claude Haiku 5.5 max Rilis: 2026-10-07 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low Rilis: 2026-08-12
Skor 8.5 8.4
Peringkat #70 #71
Keandalan 10.0 9.6
Konsistensi 9.6 9.2
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 85.5% 73.9%
Tes tidak stabil 1 2
Total Run 69 69
Biaya per hasil 2.677 19.825
Total Biaya $0.509 $4.016
Harga input $0.100 / 1M $2.000 / 1M
Harga output $0.500 / 1M $6.000 / 1M
Harga baca cache $0.010 / 1M $0.250 / 1M
Harga tulis cache $0.125 / 1M T/A
Total token input 487,516 313,881
Token output 10,212 123,706
Token penalaran 909,487 388,328
Waktu respons (rata-rata) 61.71s 120.40s
Waktu respons (maks) 288.94s 534.21s
Waktu respons (total) 1419.40s 2769.16s
Parameter ~50B 2.4T total (95B aktif)
Ketersediaan Tertutup Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Claude Haiku 5.5

max
OpenRouter returned no showcase content (finish_reason: error).
Biaya
$0.000
Waktu
164.5s
Token
0 tok

#71 Qwen3.8 2.4T A95B

low
Biaya
$0.100
Waktu
193.2s
Token
16,767 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Haiku 5.5 10.0 10.0 100.0% 0 55.87s 10,608 532 125,988
Qwen3.8 2.4T A95B 7.8 9.3 66.7% 0 172.53s 6,716 21,405 57,399

Ganti Pasangan Perbandingan