AI BENCHY Compare

Hunter Alpha vs xAI: Grok 4.1 Fast

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-12

Metrică	Hunter Alpha Hunter Alpha none Lansare: Data lansării necunoscută	Grok 4.1 Fast Grok 4.1 Fast medium Lansare: 2025-11-19

Metrică	Hunter Alpha Hunter Alpha none Lansare: Data lansării necunoscută	Grok 4.1 Fast Grok 4.1 Fast medium Lansare: 2025-11-19
Rang	#50	#32
Scor mediu	4.6	6.2
Consistență	8.0	7.9
Cost per rezultat	0.000	0.563
Cost total	$0.000	$0.051
Teste corecte
Rată de trecere pe încercare	52.1%	66.7%
Teste instabile	4	4
Rulări totale	48	48
Tokenuri de ieșire	2,272	1,183
Tokenuri de raționament	0	83,875
Timp de răspuns (mediu)	4.64s	26.35s
Timp de răspuns (maxim)	15.17s	121.79s
Timp de răspuns (total)	74.24s	237.11s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor mediu vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor mediu vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	1.3	7.4	22.2%	1		3.85s	773	0
Grok 4.1 Fast	10.0	10.0	100.0%	0		5.65s	102	4,021

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	10.0	10.0	0.0%	0		15.17s	379	0
Grok 4.1 Fast	10.0	10.0	100.0%	0		37.64s	261	12,272

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	9.9	10.0	100.0%	0		8.49s	249	0
Grok 4.1 Fast	9.9	10.0	100.0%	0		6.63s	180	5,409

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	4.0	10.0	33.3%	0		2.33s	27	0
Grok 4.1 Fast	4.0	4.4	66.7%	2		121.79s	11	37,657

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	5.0	3.1	66.7%	1		2.71s	91	0
Grok 4.1 Fast	3.0	9.9	0.0%	0		16.25s	127	3,456

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	5.0	10.0	50.0%	0		2.82s	69	0
Grok 4.1 Fast	5.5	10.0	50.0%	0		5.30s	55	3,489

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	4.0	4.4	66.7%	2		3.06s	349	0
Grok 4.1 Fast	4.0	7.2	44.4%	1		8.08s	187	6,086

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Hunter Alpha	10.0	10.0	100.0%	0		6.02s	335	0
Grok 4.1 Fast	10.0	1.6	33.3%	1		27.71s	260	11,485

Comparație rapidă

Schimbă perechea de comparație

Qwen3.5 Plus 2026-02-15nonevsGrok 4.1 Fastmedium MiniMax M2.5mediumvsHunter Alphanone Grok 4.1 FastmediumvsGLM 5none Hunter AlphanonevsGrok 4.20 Multi-Agent Betamedium gpt-oss-120bmediumDisponibil gratuitvsHunter Alphanone Claude Sonnet 4.6nonevsGrok 4.1 Fastmedium DeepSeek V3.2nonevsGrok 4.1 Fastmedium Mercury 2mediumvsHunter Alphanone Gemini 3.1 Flash Lite PreviewnonevsGrok 4.1 Fastmedium Hunter AlphanonevsQwen3.5-35B-A3Bmedium GPT-5 NanomediumvsHunter Alphanone Qwen3.5-FlashnonevsGrok 4.1 Fastmedium