AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Hunter Alpha

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-03-12

Metrik	DeepSeek V3.2 DeepSeek V3.2 none Rilis: 2025-12-01	Hunter Alpha Hunter Alpha medium Rilis: Tanggal rilis tidak diketahui

Metrik	DeepSeek V3.2 DeepSeek V3.2 none Rilis: 2025-12-01	Hunter Alpha Hunter Alpha medium Rilis: Tanggal rilis tidak diketahui
Peringkat	#37	#35
Skor Rata-rata	5.5	5.9
Konsistensi	8.4	7.6
Biaya per hasil	0.220	0.000
Total Biaya	$0.016	$0.000
Tes benar
Tingkat lulus per percobaan	54.2%	68.8%
Tes tidak stabil	3	5
Total Run	48	48
Token output	7,823	4,686
Token penalaran	0	17,821
Waktu respons (rata-rata)	12.86s	10.71s
Waktu respons (maks)	115.89s	30.53s
Waktu respons (total)	205.78s	171.41s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor Rata-rata vs Waktu respons (rata-rata)

Total token output

Skor Rata-rata vs Total token output

Rincian Kategori

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	10.0	9.7	0.0%	0		8.79s	1,411	0
Hunter Alpha	7.0	7.2	88.9%	1		4.93s	441	1,003

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	8.0	10.0	0.0%	0		115.89s	2,887	0
Hunter Alpha	10.0	1.6	66.7%	1		30.53s	792	3,456

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	5.4	5.8	66.7%	1		9.42s	1,710	0
Hunter Alpha	9.9	10.0	100.0%	0		23.16s	1,488	8,017

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	10.0	7.2	22.2%	1		1.61s	24	0
Hunter Alpha	10.0	10.0	0.0%	0		10.52s	892	2,406

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	10.0	10.0	100.0%	0		2.86s	67	0
Hunter Alpha	8.0	3.7	66.7%	1		6.44s	116	260

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0
Hunter Alpha	9.5	10.0	100.0%	0		4.18s	208	465

Puzzle Solving	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	7.7	7.5	88.9%	1		7.37s	1,136	0
Hunter Alpha	4.3	4.7	66.7%	2		5.36s	441	1,310

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0
Hunter Alpha	10.0	10.0	100.0%	0		17.33s	308	904

Perbandingan Cepat

Ganti Pasangan Perbandingan

DeepSeek V3.2nonevsGPT-5 Nanomedium DeepSeek V3.2nonevsQwen3.5-35B-A3Bmedium Hunter AlphamediumvsGLM 5none DeepSeek V3.2nonevsMercury 2medium DeepSeek V3.2nonevsNemotron 3 Super 120b A12bmediumTersedia gratis Hunter AlphamediumvsQwen3.5 Plus 2026-02-15none DeepSeek V3.2nonevsgpt-oss-120bmediumTersedia gratis DeepSeek V3.2nonevsGPT-5 Minimedium DeepSeek V3.2nonevsGrok 4.20 Multi-Agent Betamedium DeepSeek V3.2nonevsGrok 4.1 Fastmedium Hunter AlphamediumvsQwen3.5-Flashnone Gemini 2.5 FlashnonevsHunter Alphamedium