Claude Opus 4.8 (medium) vs Gemini 3.5 Flash

Modelo recomendado Claude Opus 4.8 (medium)

Tem a pontuação mais forte nesta comparação (8.8) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.

Comparação detalhada

Métrica	Claude Opus 4.8 Claude Opus 4.8 medium Lançamento: 2026-05-28	Gemini 3.5 Flash Gemini 3.5 Flash none Lançamento: 2026-05-19

Métrica	Claude Opus 4.8 Claude Opus 4.8 medium Lançamento: 2026-05-28	Gemini 3.5 Flash Gemini 3.5 Flash none Lançamento: 2026-05-19
Pontuação	8.8	7.0
Posição	#19	#87
Confiabilidade	10.0	10.0
Consistência	9.6	8.9
Testes corretos
Taxa de acerto por tentativa	84.9%	74.2%
Testes instáveis	1	3
Execuções totais	66	66
Custo por resultado	10.724	7.190
Custo total	$1.931	$1.079
Preço de entrada	$5.000 / 1M	$1.500 / 1M
Preço de saída	$25.000 / 1M	$9.000 / 1M
Total de tokens de entrada	138,451	13,843
Tokens de saída	40,766	117,518
Tokens de raciocínio	9,075	0
Tempo de resposta (médio)	12.49s	9.93s
Tempo de resposta (máx.)	70.54s	64.36s
Tempo de resposta (total)	274.72s	178.68s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

medium

none

Categoria:

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		3.95s	834	1,179	478
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.53s	492	5,101	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		15.33s	10,590	9,945	1,381
Gemini 3.5 Flash	8.8	7.8	88.9%	1		34.69s	8,122	75,927	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	9.9	10.0	100.0%	0		54.29s	101,005	19,531	4,762
Gemini 3.5 Flash	3.0	10.0	0.0%	0		0ms	0	0	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	7.1	5.6	83.3%	1		12.29s	10,503	481	312
Gemini 3.5 Flash	6.5	10.0	50.0%	0		8.10s	2,781	5,895	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	5.3	10.0	33.3%	0		14.59s	975	7,477	900
Gemini 3.5 Flash	7.6	7.2	77.8%	1		10.64s	633	17,910	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		2.46s	708	237	0
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.46s	486	1,620	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		3.32s	909	373	320
Gemini 3.5 Flash	9.8	10.0	100.0%	0		3.38s	615	3,928	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		3.95s	894	791	483
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.13s	558	4,640	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		8.96s	11,775	301	225
Gemini 3.5 Flash	3.0	10.0	0.0%	0		0ms	0	0	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	3.0	10.0	0.0%	0		6.14s	258	451	214
Gemini 3.5 Flash	2.8	1.6	33.3%	1		4.87s	156	2,497	0

Trocar par de comparação