Comparar Gráficos Metodologia

Idioma:

❤️ Made by XCS

AI BENCHY Compare

Google: Gemini 3 Pro Preview vs OpenAI: GPT-5.4

Comparar:

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-06

Métrica	Google: Gemini 3 Pro Preview medium Lançamento: 2025-11-18	OpenAI: GPT-5.4 medium Lançamento: 2026-03-05
Pontuação média	8.1	8.2
Posição	#9	#7
Testes corretos
Consistência	10.0	8.9
Custo por resultado	1.547	6.533
Custo total	$0.186	$0.784
Taxa de acerto por tentativa	80.0%	86.7%
Testes instáveis	0	2
common.totalRuns	45 (15 x 3)	45 (15 x 3)
Tokens de saída	1,424	1,611
Tokens de raciocínio	9,332	46,321
Tempo de resposta (médio)	6.87s	21.06s
Tempo de resposta (máx.)	11.96s	100.41s
Tempo de resposta (total)	55.00s	315.95s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação média vs Tempo de resposta (médio)

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	10.0	10.0	100.0%	0		3.75s	143	1,107
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		5.02s	216	1,466

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	10.0	10.0	0.0%	0		10.37s	351	952
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		20.57s	301	3,543

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	9.9	10.0	100.0%	0		10.84s	279	3,156
OpenAI: GPT-5.4	9.9	10.0	100.0%	0		5.32s	234	804

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	4.0	10.0	33.3%	0		7.01s	15	1,195
OpenAI: GPT-5.4	4.0	7.2	44.4%	1		74.27s	61	34,748

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	9.5	10.0	100.0%	0		3.26s	69	754
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		3.11s	93	897

Puzzle Solving	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	10.0	10.0	100.0%	0		3.91s	243	1,197
OpenAI: GPT-5.4	7.0	7.2	88.9%	1		9.13s	442	3,832

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Google: Gemini 3 Pro Preview	10.0	10.0	100.0%	0		11.96s	324	971
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		13.28s	264	1,031

Comparação rápida

Trocar par de comparação

Gemini 3 Flash PreviewlowvsGPT-5.4medium Gemini 3.1 Flash Lite PreviewhighvsGPT-5.4medium Gemini 3 Pro PreviewmediumvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4medium Gemini 3 Pro PreviewmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash Lite PreviewnonevsGPT-5.4medium Gemini 3 Flash PreviewnonevsGPT-5.4medium Claude Sonnet 4.6nonevsGemini 3 Pro Previewmedium Claude Sonnet 4.6nonevsGPT-5.4medium Gemini 3 Pro PreviewmediumvsQwen3.5 Plus 2026-02-15none GPT-5.4mediumvsQwen3.5 Plus 2026-02-15none Gemini 3 Pro PreviewmediumvsGLM 5none