Navegação
AI BENCHY
Advertise here

Claude Opus 5 vs Google: Gemini 3.6 Flash

Gemini 3.6 Flash (medium) lidera na pontuação média com 9.9 vs 9.2. Gemini 3.6 Flash (medium) tem menor custo de benchmark com $0.831 vs $1.486. Claude Opus 5 (medium) é mais rápido com 9.38s vs 10.11s, com taxas de acerto de 83.3% vs 98.5%.

Modelo recomendadoGemini 3.6 Flash (medium)Tem a melhor pontuação aqui (9.9) e custa cerca de 1.8x menos que Claude Opus 5 (medium).

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-25

Métrica Claude Opus 5 Claude Opus 5 medium Lançamento: 2026-07-25 Gemini 3.6 Flash Gemini 3.6 Flash medium Lançamento: 2026-07-21
Pontuação 9.2 9.9
Posição #12 #1
Confiabilidade 10.0 10.0
Consistência 9.6 9.6
Testes corretos
Taxa de acerto por tentativa 83.3% 98.5%
Testes instáveis 1 1
Execuções totais 66 66
Custo por resultado 8.253 3.955
Custo total $1.486 $0.831
Preço de entrada $5.000 / 1M $1.500 / 1M
Preço de saída $25.000 / 1M $7.500 / 1M
Total de tokens de entrada 135,607 66,293
Tokens de saída 25,673 2,000
Tokens de raciocínio 6,930 95,464
Tempo de resposta (médio) 9.38s 10.11s
Tempo de resposta (máx.) 35.05s 68.03s
Tempo de resposta (total) 206.26s 222.33s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#12 Claude Opus 5

medium
Custo
$0.125
Tempo
69.3s
Tokens
5,134 tok

#1 Gemini 3.6 Flash

medium
Custo
$0.079
Tempo
47.9s
Tokens
10,532 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Claude Opus 5 10.0 10.0 100.0% 0 9.56s 10,590 5,224 1,162
Gemini 3.6 Flash 10.0 10.0 100.0% 0 17.49s 8,136 474 40,157

Comparação rápida

Trocar par de comparação