Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemma 4 31B vs Qwen3.6 Plus Preview

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-22

Métrica Gemma 4 31B Gemma 4 31B medium Lançamento: 2026-04-02 Disponível grátis Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Lançamento: 2026-04-20 Disponível grátis
Pontuação 8.0 8.2
Posição #23 #16
Confiabilidade 6.7 N/D
Consistência 9.2 10.0
Testes corretos
Taxa de acerto por tentativa 75.0% 75.0%
Testes instáveis 2 0
Execuções totais 60 57
Custo por resultado 0.205 0.000
Custo total $0.029 $0.000
Preço de entrada $0.120 / 1M $0.000 / 1M
Preço de saída $0.370 / 1M $0.000 / 1M
Tokens de saída 19,604 1,153
Tokens de raciocínio 49,687 62,197
Tempo de resposta (médio) 35.51s 15.25s
Tempo de resposta (máx.) 150.90s 43.55s
Tempo de resposta (total) 639.17s 182.96s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 12.89s 962 2,046
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 11.69s 61 5,812
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.8 1.6 50.0% 2 110.94s 8,344 17,172
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 21.11s 1,822 2,951
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 7.7 10.0 66.7% 0 38.48s 4,349 8,985
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 9.57s 105 888
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 12.76s 533 2,035
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 3.40s 27 1,383
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 9.9 10.0 100.0% 0 27.63s 1,797 5,596
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.52s 27 2,998
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 90.14s 1,692 10,014
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0

Comparação rápida

Trocar par de comparação