AI BENCHY Compare

Hunter Alpha vs Qwen3.6 Plus Preview

Last updated at: 2026-05-01

Metric	Hunter Alpha Hunter Alpha medium Release: 2026-03-11	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Release: 2026-04-20 Free Available

Metric	Hunter Alpha Hunter Alpha medium Release: 2026-03-11	Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Release: 2026-04-20 Free Available
Score	6.7	8.5
Rank	#67	#15
Reliability	N/A	N/A
Consistency	7.4	10.0
Tests Correct
Attempt pass rate	64.8%	76.5%
Flaky tests	6	0
Total Runs	52	49
Cost per result	0.000	0.000
Total Cost	$0.000	$0.000
Input Price	$0.000 / 1M	$0.000 / 1M
Output Price	$0.000 / 1M	$0.000 / 1M
Output Tokens	4,724	1,756
Reasoning Tokens	17,921	77,213
Response Time (avg)	10.33s	13.94s
Response Time (max)	30.53s	43.55s
Response Time (total)	175.60s	237.01s

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	7.3	5.8	83.3%	2		4.75s	479	1,103
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		9.90s	207	7,557

Coding	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	3.0	10.0	0.0%	0		0ms	0	0
Qwen3.6 Plus Preview	-	-	-	-	-	-	-	-

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	4.7	1.6	66.7%	1		30.53s	792	3,456
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		34.95s	452	13,073

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	10.0	10.0	100.0%	0		23.16s	1,488	8,017
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		14.95s	270	10,706

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	3.0	10.0	0.0%	0		10.52s	892	2,406
Qwen3.6 Plus Preview	3.0	10.0	0.0%	0		22.08s	49	26,895

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	7.0	3.7	66.7%	1		6.44s	116	260
Qwen3.6 Plus Preview	5.1	10.0	0.0%	0		27.05s	111	5,232

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	9.9	10.0	100.0%	0		4.18s	208	465
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		7.54s	102	5,552

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	6.1	4.7	66.7%	2		5.36s	441	1,310
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		6.11s	298	6,868

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Hunter Alpha	10.0	10.0	100.0%	0		17.33s	308	904
Qwen3.6 Plus Preview	10.0	10.0	100.0%	0		5.87s	267	1,330

Quick Compare

Switch Comparison Pair

Qwen3.6 Plus PreviewmediumFree AvailablevsHY3 PreviewhighFree Available Qwen3.6 Plus PreviewmediumFree AvailablevsHY3 PreviewlowFree Available Gemini 3 Flash PreviewnonevsQwen3.6 Plus PreviewmediumFree Available Gemini 3 Flash PreviewlowvsQwen3.6 Plus PreviewmediumFree Available Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 Plus PreviewmediumFree Available GPT-5.2 ChatnonevsQwen3.6 Plus PreviewmediumFree Available Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 Plus PreviewmediumFree Available GPT-5.5lowvsQwen3.6 Plus PreviewmediumFree Available GPT-5.3 ChatnonevsQwen3.6 Plus PreviewmediumFree Available DeepSeek V4 FlashhighvsQwen3.6 Plus PreviewmediumFree Available Claude Opus 4.7nonevsQwen3.6 Plus PreviewmediumFree Available Claude Sonnet 4.6nonevsQwen3.6 Plus PreviewmediumFree Available