AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Hunter Alpha

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-03-12

Metrik	Claude Sonnet 4.6 Claude Sonnet 4.6 none Rilis: 2026-02-17	Hunter Alpha Hunter Alpha medium Rilis: Tanggal rilis tidak diketahui

Metrik	Claude Sonnet 4.6 Claude Sonnet 4.6 none Rilis: 2026-02-17	Hunter Alpha Hunter Alpha medium Rilis: Tanggal rilis tidak diketahui
Peringkat	#27	#35
Skor Rata-rata	6.8	5.9
Konsistensi	9.6	7.6
Biaya per hasil	2.504	0.000
Total Biaya	$0.251	$0.000
Tes benar
Tingkat lulus per percobaan	66.7%	68.8%
Tes tidak stabil	1	5
Total Run	48	48
Token output	6,895	4,686
Token penalaran	0	17,821
Waktu respons (rata-rata)	5.57s	10.71s
Waktu respons (maks)	23.84s	30.53s
Waktu respons (total)	50.12s	171.41s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor Rata-rata vs Waktu respons (rata-rata)

Total token output

Skor Rata-rata vs Total token output

Rincian Kategori

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	4.0	10.0	33.3%	0		4.83s	1,199	0
Hunter Alpha	7.0	7.2	88.9%	1		4.93s	441	1,003

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	9.0	10.0	100.0%	0		23.84s	3,766	0
Hunter Alpha	10.0	1.6	66.7%	1		30.53s	792	3,456

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	9.9	10.0	100.0%	0		3.43s	252	0
Hunter Alpha	9.9	10.0	100.0%	0		23.16s	1,488	8,017

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	7.0	10.0	66.7%	0		3.54s	413	0
Hunter Alpha	10.0	10.0	0.0%	0		10.52s	892	2,406

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	5.0	3.1	66.7%	1		2.56s	192	0
Hunter Alpha	8.0	3.7	66.7%	1		6.44s	116	260

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	5.5	10.0	50.0%	0		1.96s	90	0
Hunter Alpha	9.5	10.0	100.0%	0		4.18s	208	465

Puzzle Solving	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	7.0	10.0	66.7%	0		2.92s	536	0
Hunter Alpha	4.3	4.7	66.7%	2		5.36s	441	1,310

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	447	0
Hunter Alpha	10.0	10.0	100.0%	0		17.33s	308	904

Perbandingan Cepat

Ganti Pasangan Perbandingan

Hunter AlphamediumvsGLM 5none Claude Sonnet 4.6nonevsQwen3.5-Flashmedium Claude Sonnet 4.6nonevsSeed-2.0-Minimedium Claude Sonnet 4.6nonevsGrok 4.20 Betamedium Claude Sonnet 4.6nonevsGPT-5.2medium Hunter AlphamediumvsQwen3.5 Plus 2026-02-15none Claude Sonnet 4.6nonevsKimi K2.5medium DeepSeek V3.2nonevsHunter Alphamedium Claude Sonnet 4.6nonevsMiMo-V2-Flashmedium Claude Sonnet 4.6nonevsDeepSeek V3.2medium Claude Sonnet 4.6nonevsGemini 3.1 Flash Lite Previewlow Claude Sonnet 4.6nonevsGrok 4.1 Fastmedium