Navigasi
Advertise here

Claude Fable 5.1 (high) vs DeepSeek V4.1 Flash (low)

DeepSeek V4.1 Flash (low) unggul dalam skor rata-rata dengan 8.0 vs 7.9. DeepSeek V4.1 Flash (low) memiliki biaya benchmark lebih rendah di $0.153 vs $3.471. Claude Fable 5.1 (high) lebih cepat di 13.30s vs 28.04s, dengan tingkat keberhasilan 85.5% vs 73.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#98
Total token output
40,466
Waktu respons (rata-rata)
13.30s
Total Biaya
$3.471
Peringkat
#90
Total token output
371,547
Waktu respons (rata-rata)
28.04s
Total Biaya
$0.153
Model yang direkomendasikan DeepSeek V4.1 Flash (low)

It has the best score here (8.0), while costing about 22.8x less than Claude Fable 5.1 (high).

Perbandingan terperinci

Metrik Claude Fable 5.1 Claude Fable 5.1 high Rilis: 2026-09-02 DeepSeek V4.1 Flash DeepSeek V4.1 Flash low Rilis: 2026-09-10
Skor 7.9 8.0
Peringkat #98 #90
Keandalan 10.0 9.6
Konsistensi 9.7 8.7
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 85.5% 73.9%
Tes tidak stabil 1 4
Total Run 69 69
Biaya per hasil 18.264 1.576
Total Biaya $3.471 $0.153
Harga input $10.000 / 1M $0.020 / 1M
Harga output $50.000 / 1M $0.396 / 1M
Total token input 144,676 266,849
Token output 8,184 8,284
Token penalaran 32,282 363,263
Waktu respons (rata-rata) 13.30s 28.04s
Waktu respons (maks) 40.17s 149.84s
Waktu respons (total) 305.83s 645.03s
Parameter ~9.5T total (~878B aktif) 748B total (16B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Claude Fable 5.1

high
Biaya
$0.384
Waktu
102.5s
Token
7,824 tok

#90 DeepSeek V4.1 Flash

low
Biaya
$0.017
Waktu
43.6s
Token
14,069 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Fable 5.1 8.4 7.4 88.9% 1 13.91s 10,608 520 6,503
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 40.66s 7,509 378 81,978

Perbandingan Cepat

Ganti Pasangan Perbandingan