Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

Google: Gemma 4 31B vs Qwen: Qwen3.5-122B-A10B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica Gemma 4 31B Gemma 4 31B medium Lançamento: 2026-04-02 Qwen3.5-122B-A10B Qwen3.5-122B-A10B medium Lançamento: 2026-02-24
Pontuação 8.6 8.4
Posição #5 #12
Consistência 9.6 9.0
Testes corretos
Taxa de acerto por tentativa 80.4% 80.4%
Testes instáveis 1 2
Execuções totais 51 51
Custo por resultado 0.109 3.883
Custo total $0.015 $0.505
Preço de entrada $0.140 / 1M $0.260 / 1M
Preço de saída $0.400 / 1M $2.080 / 1M
Tokens de saída 9,568 17,313
Tokens de raciocínio 22,501 151,974
Tempo de resposta (médio) 21.81s 29.05s
Tempo de resposta (máx.) 68.92s 119.29s
Tempo de resposta (total) 327.16s 493.86s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.75s 269 16,835
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 107.79s 483 11,337
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 23.41s 270 16,558
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Qwen3.5-122B-A10B 2.9 7.2 11.1% 1 63.40s 15,537 64,889
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Qwen3.5-122B-A10B 3.4 2.2 33.3% 1 34.11s 66 7,592
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 9.88s 77 7,372
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 8.8 7.9 88.9% 1 27.63s 1,797 5,596
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 17.18s 289 26,165
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 4.60s 322 1,226

Comparação rápida

Trocar par de comparação