Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 4.6 (medium) vs DeepSeek V4 Pro (high)

Claude Sonnet 4.6 (medium) unggul dalam skor rata-rata dengan 7.8 vs 7.7. DeepSeek V4 Pro (high) memiliki biaya benchmark lebih rendah di $0.200 vs $2.057. Claude Sonnet 4.6 (medium) lebih cepat di 25.91s vs 79.14s, dengan tingkat keberhasilan 66.7% vs 63.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-01

Peringkat
#51
Total token output
115,865
Waktu respons (rata-rata)
25.91s
Total Biaya
$2.057
Peringkat
#58
Total token output
189,181
Waktu respons (rata-rata)
79.14s
Total Biaya
$0.200
Model yang direkomendasikan DeepSeek V4 Pro (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 10.3x less than Claude Sonnet 4.6 (medium).

Perbandingan terperinci

Metrik Claude Sonnet 4.6 Claude Sonnet 4.6 medium Rilis: 2026-02-17 DeepSeek V4 Pro DeepSeek V4 Pro high Rilis: 2026-04-24
Skor 7.8 7.7
Peringkat #51 #58
Keandalan 10.0 10.0
Konsistensi 9.2 7.7
Tes benar
Tingkat lulus per percobaan 66.7% 63.6%
Tes tidak stabil 2 6
Total Run 66 66
Biaya per hasil 14.692 2.000
Total Biaya $2.057 $0.200
Harga input $3.000 / 1M $0.435 / 1M
Harga output $15.000 / 1M $0.870 / 1M
Total token input 106,292 90,748
Token output 80,748 10,462
Token penalaran 35,117 178,719
Waktu respons (rata-rata) 25.91s 79.14s
Waktu respons (maks) 140.96s 416.76s
Waktu respons (total) 362.78s 1740.97s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 Claude Sonnet 4.6

medium
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

#58 DeepSeek V4 Pro

high
Biaya
$0.023
Waktu
257.6s
Token
14,870 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580

Perbandingan Cepat

Ganti Pasangan Perbandingan