Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemma 4 31B vs Qwen: Qwen3.6 27B

Resumo

Comparação benchmark Gemma 4 31B vs Qwen3.6 27B: Qwen3.6 27B lidera na pontuação média com 6.8 vs 6.5. Gemma 4 31B tem menor custo de benchmark com $0.004 vs $0.336. Gemma 4 31B é mais rápido com 4.05s vs 59.71s, com taxas de acerto de 47.6% vs 60.3%.

Modelo recomendado: Gemma 4 31B - A pontuação fica perto da melhor aqui (6.5 vs 6.8) e custa cerca de 111.3x menos que Qwen3.6 27B.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-10

Métrica Gemma 4 31B Gemma 4 31B none Lançamento: 2026-04-02 Disponível grátis Qwen3.6 27B Qwen3.6 27B medium Lançamento: 2026-04-20
Pontuação 6.5 6.8
Posição #86 #79
Confiabilidade 10.0 10.0
Consistência 10.0 8.2
Testes corretos
Taxa de acerto por tentativa 47.6% 60.3%
Testes instáveis 0 5
Execuções totais 63 63
Custo por resultado 0.034 3.361
Custo total $0.004 $0.336
Preço de entrada $0.120 / 1M $0.290 / 1M
Preço de saída $0.360 / 1M $2.400 / 1M
Total de tokens de entrada 20,911 39,376
Tokens de saída 1,407 16,189
Tokens de raciocínio 0 122,521
Tempo de resposta (médio) 4.05s 59.71s
Tempo de resposta (máx.) 26.13s 168.22s
Tempo de resposta (total) 76.87s 1254.01s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Gemma 4 31B

none
Cost
$0.001
Time
12.8s
Tokens
795 tok

#79 Qwen3.6 27B

medium
Cost
$0.009
Time
39.6s
Tokens
3,090 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 50.0% 0 1.85s 852 45 0
Qwen3.6 27B 8.3 10.0 75.0% 0 12.62s 453 582 4,311
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Qwen3.6 27B 7.0 3.7 66.7% 1 83.07s 15,104 2,088 14,689
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 2.25s 8,352 285 0
Qwen3.6 27B 3.5 1.4 50.0% 2 37.30s 7,778 568 9,404
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 7.7 10.0 66.7% 0 3.22s 903 27 0
Qwen3.6 27B 2.9 7.2 11.1% 1 73.38s 662 3,510 20,352
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 10.0 10.0 100.0% 0 2.09s 576 117 0
Qwen3.6 27B 6.5 3.4 66.7% 1 39.53s 516 81 3,045
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 50.0% 0 2.84s 795 78 0
Qwen3.6 27B 10.0 10.0 100.0% 0 37.96s 699 346 6,548
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 6.5 10.0 33.3% 0 4.23s 828 108 0
Qwen3.6 27B 7.7 10.0 66.7% 0 61.14s 696 255 12,044
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 0ms 0 0 0
Qwen3.6 27B 10.0 10.0 100.0% 0 16.88s 8,213 390 2,954
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemma 4 31B 3.0 10.0 0.0% 0 1.25s 224 12 0
Qwen3.6 27B 3.0 10.0 0.0% 0 80.99s 204 401 5,807

Comparação rápida

Trocar par de comparação