AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs LiquidAI: LFM2-24B-A2B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-22

Métrica	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Lançamento: 2026-02-19	LFM2-24B-A2B LFM2-24B-A2B none Lançamento: 2026-02-24

Métrica	Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Lançamento: 2026-02-19	LFM2-24B-A2B LFM2-24B-A2B none Lançamento: 2026-02-24
Pontuação	9.3	4.2
Posição	#4	#152
Confiabilidade	10.0	N/D
Consistência	10.0	9.0
Testes corretos
Taxa de acerto por tentativa	90.0%	18.8%
Testes instáveis	0	2
Execuções totais	60	48
Custo por resultado	5.586	0.024
Custo total	$1.006	$0.001
Preço de entrada	$2.000 / 1M	$0.030 / 1M
Preço de saída	$12.000 / 1M	$0.120 / 1M
Tokens de saída	1,968	1,185
Tokens de raciocínio	75,373	0
Tempo de resposta (médio)	20.80s	811ms
Tempo de resposta (máx.)	88.68s	2.88s
Tempo de resposta (total)	270.46s	11.35s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.90s	112	3,218
LFM2-24B-A2B	3.3	9.8	0.0%	0		471ms	490	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	7.0	9.8	50.0%	0		54.28s	429	37,735
LFM2-24B-A2B	-	-	-	-	-	-	-	-

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	9.5	10.0	100.0%	0		40.61s	432	9,281
LFM2-24B-A2B	3.0	10.0	0.0%	0		0ms	0	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.72s	279	3,904
LFM2-24B-A2B	3.0	10.0	0.0%	0		714ms	219	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	7.7	10.0	66.7%	0		32.73s	18	12,424
LFM2-24B-A2B	5.9	7.2	55.6%	1		287ms	30	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		11.77s	108	1,179
LFM2-24B-A2B	4.0	10.0	0.0%	0		395ms	72	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		9.56s	72	2,236
LFM2-24B-A2B	6.3	10.0	50.0%	0		1.09s	60	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		7.15s	232	3,117
LFM2-24B-A2B	3.7	7.7	11.1%	1		1.69s	314	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		23.15s	274	982
LFM2-24B-A2B	3.0	10.0	0.0%	0		0ms	0	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Pro Preview	10.0	10.0	100.0%	0		6.27s	12	1,297
LFM2-24B-A2B	-	-	-	-	-	-	-	-

Comparação rápida

Trocar par de comparação

Gemini 3.1 Pro PreviewmediumvsGPT-5.5low Gemini 3.1 Pro PreviewmediumvsQwen3.7 Maxnone Gemini 3.1 Pro PreviewmediumvsGPT-5.2 Chatnone Gemini 3.1 Pro PreviewmediumvsGPT-5.3 Chatnone DeepSeek V4 FlashhighDisponível grátisvsGemini 3.1 Pro Previewmedium Gemini 3.1 Pro PreviewmediumvsRing-2.6-1Tnone Gemini 3.1 Pro PreviewmediumvsQwen3.6 Max Previewnone Claude Sonnet 4.6nonevsGemini 3.1 Pro Previewmedium DeepSeek V4 ProhighvsGemini 3.1 Pro Previewmedium Gemini 3.1 Pro PreviewmediumvsGrok Build 0.1none Gemini 3.1 Pro PreviewmediumvsGPT-5.5none Gemini 3.1 Pro PreviewmediumvsQwen3.5 Plus 2026-02-15none