Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Google: Gemini 3 Flash Preview

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-19

Métrica Gemini 2.5 Flash Gemini 2.5 Flash medium Lançamento: 2025-06-17 Gemini 3 Flash Preview Gemini 3 Flash Preview none Lançamento: 2025-12-17
Pontuação 7.9 7.9
Posição #30 #34
Confiabilidade 10.0 10.0
Consistência 9.6 9.1
Testes corretos
Taxa de acerto por tentativa 71.9% 73.7%
Testes instáveis 1 2
Execuções totais 57 57
Custo por resultado 2.472 0.157
Custo total $0.322 $0.021
Preço de entrada $0.300 / 1M $0.500 / 1M
Preço de saída $2.500 / 1M $3.000 / 1M
Tokens de saída 1,909 1,855
Tokens de raciocínio 123,192 0
Tempo de resposta (médio) 11.63s 1.61s
Tempo de resposta (máx.) 95.48s 3.56s
Tempo de resposta (total) 220.88s 19.26s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 214 0
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 10.0 10.0 100.0% 0 16.23s 522 10,350
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.59s 423 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 350 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 279 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 18 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 104 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 74 0
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.06s 144 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 234 0
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 2.5 Flash 3.0 10.0 0.0% 0 2.76s 11 919
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 15 0

Comparação rápida

Trocar par de comparação