Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemma 4 31B vs OpenAI: GPT-5.5

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-22

Métrica Gemma 4 31B Gemma 4 31B none Lançamento: 2026-04-02 Disponível grátis GPT-5.5 GPT-5.5 medium Lançamento: 2026-04-24
Pontuação 6.7 8.7
Posição #76 #11
Confiabilidade 10.0 10.0
Consistência 10.0 8.8
Testes corretos
Taxa de acerto por tentativa 50.0% 86.7%
Testes instáveis 0 3
Execuções totais 60 60
Custo por resultado 0.030 21.891
Custo total $0.003 $3.503
Preço de entrada $0.120 / 1M $5.000 / 1M
Preço de saída $0.370 / 1M $30.000 / 1M
Tokens de saída 1,398 1,973
Tokens de raciocínio 0 109,510
Tempo de resposta (médio) 3.84s 37.89s
Tempo de resposta (máx.) 26.13s 332.10s
Tempo de resposta (total) 69.13s 757.71s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 45 0
GPT-5.5 10.0 10.0 100.0% 0 4.66s 250 1,335
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.8 10.0 50.0% 0 14.84s 726 0
GPT-5.5 8.2 6.7 83.3% 1 69.68s 341 19,515
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.5 10.0 10.0 100.0% 0 19.29s 312 2,841
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 285 0
GPT-5.5 10.0 10.0 100.0% 0 4.18s 234 593
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 27 0
GPT-5.5 5.3 7.2 44.4% 1 164.14s 67 79,625
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 117 0
GPT-5.5 10.0 10.0 100.0% 0 4.16s 138 223
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 78 0
GPT-5.5 10.0 10.0 100.0% 0 3.36s 93 538
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 33.3% 0 2.95s 108 0
GPT-5.5 10.0 10.0 100.0% 0 6.78s 250 2,254
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.5 10.0 10.0 100.0% 0 10.57s 258 832
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 12 0
GPT-5.5 2.8 1.6 33.3% 1 37.86s 30 1,754

Comparação rápida

Trocar par de comparação