AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.6 Max Preview

Ringkasan

Perbandingan benchmark DeepSeek V4 Pro vs Qwen3.6 Max Preview: Qwen3.6 Max Preview unggul dalam skor rata-rata dengan 8.9 vs 7.6. DeepSeek V4 Pro memiliki biaya benchmark lebih rendah di $0.157 vs $0.960. Qwen3.6 Max Preview lebih cepat di 59.63s vs 77.20s, dengan tingkat keberhasilan 66.7% vs 81.0%.

Model yang direkomendasikan: Qwen3.6 Max Preview - It has the strongest score in this comparison (8.9) and the best overall balance of cost and response time across all 2 models.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-06-18

Metrik	DeepSeek V4 Pro DeepSeek V4 Pro high Rilis: 2026-04-24	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Rilis: 2026-04-20

Metrik	DeepSeek V4 Pro DeepSeek V4 Pro high Rilis: 2026-04-24	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Rilis: 2026-04-20
Skor	7.6	8.9
Peringkat	#41	#11
Keandalan	9.3	10.0
Konsistensi	7.0	9.3
Tes benar
Tingkat lulus per percobaan	66.7%	81.0%
Tes tidak stabil	8	2
Total Run	63	63
Biaya per hasil	1.742	7.024
Total Biaya	$0.157	$0.960
Harga input	$0.435 / 1M	$1.040 / 1M
Harga output	$0.870 / 1M	$6.240 / 1M
Total token input	38,726	42,362
Token output	6,334	2,273
Token penalaran	159,151	144,367
Waktu respons (rata-rata)	77.20s	59.63s
Waktu respons (maks)	416.76s	238.07s
Waktu respons (total)	1621.17s	1252.17s

Showcase generasi

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 DeepSeek V4 Pro

high

Biaya: $0.023
Waktu: 257.6s
Token: 14,870 tok

#11 Qwen3.6 Max Preview

medium

Biaya: $0.024
Waktu: 76.5s
Token: 3,861 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	5.7	5.9	58.3%	2		25.70s	536	149	3,214
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	672	228	10,075

Pemrograman	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	6.1	4.6	66.7%	2		243.00s	5,090	383	84,580
Qwen3.6 Max Preview	8.8	7.8	88.9%	1		146.48s	7,895	427	52,957

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	10.0	10.0	100.0%	0		38.17s	14,060	454	5,836
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		121.49s	14,934	390	14,575

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	10.0	10.0	100.0%	0		25.03s	7,690	274	2,166
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	7,782	270	10,106

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	3.6	7.2	22.2%	1		151.46s	569	4,404	50,391
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	771	60	30,371

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	10.0	10.0	100.0%	0		8.83s	471	115	1,013
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	516	129	3,510

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	7.8	6.6	83.3%	1		8.73s	627	66	2,726
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	699	103	5,848

Pemecahan teka-teki	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	6.9	4.9	77.8%	2		56.85s	591	178	2,563
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.32s	696	329	7,693

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	9.8	10.0	100.0%	0		15.92s	8,909	295	701
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	8,193	309	1,571

Pengetahuan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
DeepSeek V4 Pro	3.0	10.0	0.0%	0		34.01s	183	16	5,961
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		60.56s	204	28	7,661

Perbandingan Cepat

Ganti Pasangan Perbandingan

DeepSeek V4 ProhighvsMiniMax M3medium DeepSeek V4 ProhighvsGrok Build 0.1medium DeepSeek V4 ProhighvsKimi K2.5medium DeepSeek V4 ProhighvsMercury 2medium DeepSeek V4 ProhighvsStep 3.7 Flashlow Claude Opus 4.6mediumvsDeepSeek V4 Prohigh DeepSeek V4 ProhighvsGPT-5.3 Chatnone DeepSeek V4 ProhighvsGPT-5.4 Nanomedium DeepSeek V4 ProhighvsGrok 4.3medium DeepSeek V4 ProhighvsQwen3.5-122B-A10Bmedium DeepSeek V4 ProhighvsQwen3.6 Flashmedium DeepSeek V4 ProhighvsKimi K2.6mediumTersedia gratis