AI BENCHY Compare

Hunter Alpha vs Qwen: Qwen3.5-9B

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-12

Metrică	Hunter Alpha Hunter Alpha none Lansare: Data lansării necunoscută	Qwen3.5-9B Qwen3.5-9B medium Lansare: 2026-03-02

Metrică	Hunter Alpha Hunter Alpha none Lansare: Data lansării necunoscută	Qwen3.5-9B Qwen3.5-9B medium Lansare: 2026-03-02
Rang	#50	#66
Scor mediu	4.6	2.6
Consistență	8.0	7.4
Cost per rezultat	0.000	0.779
Cost total	$0.000	$0.024
Teste corecte
Rată de trecere pe încercare	52.1%	35.4%
Teste instabile	4	5
Rulări totale	48	48
Tokenuri de ieșire	2,272	17,930
Tokenuri de raționament	0	139,706
Timp de răspuns (mediu)	4.64s	71.44s
Timp de răspuns (maxim)	15.17s	226.38s
Timp de răspuns (total)	74.24s	928.77s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor mediu vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor mediu vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	1.3	7.4	22.2%	1		3.85s	773	0
Qwen3.5-9B	4.0	7.2	55.6%	1		31.54s	2,410	10,913

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	10.0	10.0	0.0%	0		15.17s	379	0
Qwen3.5-9B	10.0	10.0	0.0%	0		0ms	0	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	9.9	10.0	100.0%	0		8.49s	249	0
Qwen3.5-9B	5.0	5.6	33.3%	1		87.31s	1,383	32,113

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	4.0	10.0	33.3%	0		2.33s	27	0
Qwen3.5-9B	10.0	7.2	22.2%	1		137.75s	11,549	48,475

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	5.0	3.1	66.7%	1		2.71s	91	0
Qwen3.5-9B	10.0	1.6	33.3%	1		226.38s	0	30,695

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	5.0	10.0	50.0%	0		2.82s	69	0
Qwen3.5-9B	5.5	5.8	66.7%	1		17.15s	599	4,517

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	4.0	4.4	66.7%	2		3.06s	349	0
Qwen3.5-9B	10.0	10.0	0.0%	0		33.38s	1,545	11,844

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	10.0	10.0	100.0%	0		6.02s	335	0
Qwen3.5-9B	10.0	10.0	100.0%	0		4.31s	444	1,149

Comparație rapidă

Schimbă perechea de comparație

MiniMax M2.5mediumvsHunter Alphanone Qwen3.5-9BmediumvsMiMo-V2-Flashnone Qwen3.5-9BmediumvsGrok 4.1 Fastnone Hunter AlphanonevsGrok 4.20 Multi-Agent Betamedium gpt-oss-120bmediumDisponibil gratuitvsHunter Alphanone Mercury 2mediumvsHunter Alphanone Mercury 2nonevsQwen3.5-9Bmedium Nemotron 3 Super 120b A12bnoneDisponibil gratuitvsQwen3.5-9Bmedium Hunter AlphanonevsQwen3.5-35B-A3Bmedium GPT-5 NanomediumvsHunter Alphanone Hunter AlphanonevsQwen3 Coder Nextmedium Nemotron 3 Super 120b A12bmediumDisponibil gratuitvsHunter Alphanone