Claude Opus 4.6 (medium) vs DeepSeek V4 Pro (high)

Model yang direkomendasikan DeepSeek V4 Pro (high)

It has the best score here (7.7), while costing about 15.3x less than Claude Opus 4.6 (medium).

Perbandingan terperinci

Metrik	Claude Opus 4.6 Claude Opus 4.6 medium Rilis: 2026-02-05	DeepSeek V4 Pro DeepSeek V4 Pro high Rilis: 2026-04-24

Metrik	Claude Opus 4.6 Claude Opus 4.6 medium Rilis: 2026-02-05	DeepSeek V4 Pro DeepSeek V4 Pro high Rilis: 2026-04-24
Skor	7.7	7.7
Peringkat	#55	#58
Keandalan	10.0	10.0
Konsistensi	8.8	7.7
Tes benar
Tingkat lulus per percobaan	63.6%	63.6%
Tes tidak stabil	3	6
Total Run	66	66
Biaya per hasil	23.524	2.000
Total Biaya	$3.059	$0.200
Harga input	$5.000 / 1M	$0.435 / 1M
Harga output	$25.000 / 1M	$0.870 / 1M
Total token input	108,615	90,748
Token output	72,286	10,462
Token penalaran	28,315	178,719
Waktu respons (rata-rata)	34.27s	79.14s
Waktu respons (maks)	151.51s	416.76s
Waktu respons (total)	513.99s	1740.97s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

medium

SVG tidak valid

high

Kategori:

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	6.4	5.8	66.7%	2		7.45s	840	986	1,071
DeepSeek V4 Pro	5.7	5.9	58.3%	2		25.70s	536	149	3,214

Pemrograman	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	5.7	7.1	44.4%	1		30.10s	8,522	13,057	4,121
DeepSeek V4 Pro	6.3	8.7	33.3%	0		243.00s	5,090	383	84,580

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	10.0	10.0	100.0%	0		114.08s	76,073	33,018	9,509
DeepSeek V4 Pro	10.0	10.0	100.0%	0		78.99s	66,082	4,582	25,404

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	10.0	10.0	100.0%	0		7.37s	8,676	691	757
DeepSeek V4 Pro	10.0	10.0	100.0%	0		25.03s	7,690	274	2,166

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	3.0	10.0	0.0%	0		83.40s	674	14,642	8,687
DeepSeek V4 Pro	3.6	7.2	22.2%	1		151.46s	569	4,404	50,391

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	10.0	10.0	100.0%	0		5.04s	564	188	292
DeepSeek V4 Pro	10.0	10.0	100.0%	0		8.83s	471	115	1,013

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	10.0	10.0	100.0%	0		2.43s	792	266	467
DeepSeek V4 Pro	7.8	6.6	83.3%	1		8.73s	627	66	2,726

Pemecahan teka-teki	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	7.7	10.0	66.7%	0		4.71s	816	532	630
DeepSeek V4 Pro	6.9	4.9	77.8%	2		56.85s	591	178	2,563

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	10.0	10.0	100.0%	0		9.73s	11,454	861	329
DeepSeek V4 Pro	9.8	10.0	100.0%	0		15.92s	8,909	295	701

Pengetahuan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Claude Opus 4.6	3.0	10.0	0.0%	0		63.24s	204	8,045	2,452
DeepSeek V4 Pro	3.0	10.0	0.0%	0		34.01s	183	16	5,961

Ganti Pasangan Perbandingan