Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs xAI: Grok 4.20

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Lançamento: 2026-03-03 Grok 4.20 Grok 4.20 medium Lançamento: 2026-03-31
Pontuação 8.0 7.1
Posição #20 #40
Consistência 10.0 8.2
Testes corretos
Taxa de acerto por tentativa 70.6% 66.7%
Testes instáveis 0 4
Execuções totais 51 51
Custo por resultado 0.168 7.358
Custo total $0.021 $0.663
Preço de entrada $0.250 / 1M $2.000 / 1M
Preço de saída $1.500 / 1M $6.000 / 1M
Tokens de saída 1,617 1,494
Tokens de raciocínio 7,686 97,078
Tempo de resposta (médio) 3.28s 9.50s
Tempo de resposta (máx.) 11.91s 29.87s
Tempo de resposta (total) 55.80s 161.54s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 462 1,638
Grok 4.20 8.2 7.9 83.3% 1 3.36s 280 8,476
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 225 762
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 291 696
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 18 1,212
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 69 384
Grok 4.20 5.8 2.8 66.7% 1 7.09s 47 4,252
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 72 753
Grok 4.20 7.3 5.9 83.3% 1 4.42s 40 5,474
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 2.76s 243 1,248
Grok 4.20 6.4 7.7 55.6% 1 3.89s 143 8,028
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 237 993
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620

Comparação rápida

Trocar par de comparação