Navegação
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.1 Flash Lite Preview vs Grok 4.20 (medium)

Grok 4.20 (medium) lidera na pontuação média com 6.3 vs 6.2. Gemini 3.1 Flash Lite Preview tem menor custo de benchmark com $0.090 vs $1.582. Gemini 3.1 Flash Lite Preview é mais rápido com 3.60s vs 36.73s, com taxas de acerto de 55.1% vs 58.0%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-01

Modelos comparados

Posição
#230
Total de tokens de saída
15,760
Tempo de resposta (médio)
3.60s
Custo total
$0.090
Posição
#224
Total de tokens de saída
302,087
Tempo de resposta (médio)
36.73s
Custo total
$1.582
Modelo recomendado Gemini 3.1 Flash Lite Preview

A pontuação fica perto da melhor aqui (6.2 vs 6.3) e custa cerca de 17.7x menos que Grok 4.20 (medium).

Comparação detalhada

Métrica Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview none Lançamento: 2026-03-03 Grok 4.20 Grok 4.20 medium Lançamento: 2026-03-31
Pontuação 6.2 6.3
Posição #230 #224
Confiabilidade 10.0 10.0
Consistência 9.7 8.2
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 55.1% 58.0%
Testes instáveis 1 5
Execuções totais 69 69
Custo por resultado 0.743 14.374
Custo total $0.090 $1.582
Preço de entrada $0.250 / 1M $1.250 / 1M
Preço de saída $1.500 / 1M $2.500 / 1M
Total de tokens de entrada 261,962 392,127
Tokens de saída 15,760 7,754
Tokens de raciocínio 0 294,333
Tempo de resposta (médio) 3.60s 36.73s
Tempo de resposta (máx.) 48.59s 199.66s
Tempo de resposta (total) 82.91s 844.68s
Parâmetros ~150B no total (~10B ativos) ~1T no total (~100B ativos)
Disponibilidade Código fechado Código fechado

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#230 Gemini 3.1 Flash Lite Preview

none
Custo
$0.003
Tempo
4.7s
Tokens
1,827 tok

#224 SpaceXAI: Grok 4.20

medium
Custo
$0.041
Tempo
110.3s
Tokens
16,336 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 967ms 8,128 670 0
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

Comparação rápida

Trocar par de comparação