AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs Hunter Alpha

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-17

Métrica	GPT-5.2 Chat GPT-5.2 Chat none Lançamento: 2025-12-11	Hunter Alpha Hunter Alpha medium Lançamento: Data de lançamento desconhecida

Métrica	GPT-5.2 Chat GPT-5.2 Chat none Lançamento: 2025-12-11	Hunter Alpha Hunter Alpha medium Lançamento: Data de lançamento desconhecida
Posição	#24	#35
Pontuação	7.8	7.0
Consistência	8.6	7.2
Custo por resultado	2.462	0.000
Custo total	$0.271	$0.000
Testes corretos
Taxa de acerto por tentativa	74.5%	68.6%
Testes instáveis	3	6
Execuções totais	51	51
Tokens de saída	16,001	4,724
Tokens de raciocínio	0	17,921
Tempo de resposta (médio)	6.72s	10.33s
Tempo de resposta (máx.)	38.52s	30.53s
Tempo de resposta (total)	114.20s	175.60s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	1,807	0
Hunter Alpha	7.3	5.8	83.3%	2		4.75s	479	1,103

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	1,243	0
Hunter Alpha	4.7	1.6	66.7%	1		30.53s	792	3,456

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	980	0
Hunter Alpha	10.0	10.0	100.0%	0		23.16s	1,488	8,017

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	7,810	0
Hunter Alpha	3.0	10.0	0.0%	0		10.52s	892	2,406

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	335	0
Hunter Alpha	7.0	3.7	66.7%	1		6.44s	116	260

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	7.5	6.1	83.3%	1		5.46s	1,528	0
Hunter Alpha	9.9	10.0	100.0%	0		4.18s	208	465

Puzzle Solving	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.42s	1,743	0
Hunter Alpha	6.1	4.7	66.7%	2		5.36s	441	1,310

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	555	0
Hunter Alpha	10.0	10.0	100.0%	0		17.33s	308	904

Comparação rápida

Trocar par de comparação

GPT-5.2 ChatnonevsStep 3.5 FlashmediumDisponível grátis GPT-5.2 ChatnonevsGrok 4.20 Betamedium Claude Sonnet 4.6mediumvsGPT-5.2 Chatnone Hunter AlphamediumvsQwen3.5 Plus 2026-02-15none GPT-5.2 ChatnonevsQwen3.5-Flashmedium GPT-5.2 ChatnonevsMiMo-V2-Flashmedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsGLM 5 Turbomedium Hunter AlphamediumvsGLM 5none Claude Opus 4.6mediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewmediumvsGPT-5.2 Chatnone Claude Sonnet 4.6nonevsHunter Alphamedium