Navegação
AI BENCHY
Advertise here

Gemini 3.1 Flash Lite (minimal) vs Qwen3.6 Max Preview

Qwen3.6 Max Preview lidera na pontuação média com 6.6 vs 6.1. Gemini 3.1 Flash Lite (minimal) tem menor custo de benchmark com $0.047 vs $0.231. Gemini 3.1 Flash Lite (minimal) é mais rápido com 1.86s vs 7.82s, com taxas de acerto de 51.5% vs 60.6%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-28

Posição
#134
Total de tokens de saída
11,118
Tempo de resposta (médio)
1.86s
Custo total
$0.047
Posição
#110
Total de tokens de saída
19,257
Tempo de resposta (médio)
7.82s
Custo total
$0.231
Modelo recomendado Gemini 3.1 Flash Lite (minimal)

A pontuação fica perto da melhor aqui (6.1 vs 6.6) e custa cerca de 5.0x menos que Qwen3.6 Max Preview.

Comparação detalhada

Métrica Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lançamento: 2026-05-08 Qwen3.6 Max Preview Qwen3.6 Max Preview none Lançamento: 2026-04-20
Pontuação 6.1 6.6
Posição #134 #110
Confiabilidade 10.0 9.9
Consistência 8.9 9.3
Testes corretos
Taxa de acerto por tentativa 51.5% 60.6%
Testes instáveis 3 2
Execuções totais 66 66
Custo por resultado 0.465 2.061
Custo total $0.047 $0.231
Preço de entrada $0.250 / 1M $1.040 / 1M
Preço de saída $1.500 / 1M $6.240 / 1M
Total de tokens de entrada 119,065 106,339
Tokens de saída 11,118 19,257
Tokens de raciocínio 0 0
Tempo de resposta (médio) 1.86s 7.82s
Tempo de resposta (máx.) 12.97s 102.62s
Tempo de resposta (total) 40.88s 172.01s

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 Gemini 3.1 Flash Lite

minimal
Custo
$0.001
Tempo
3.7s
Tokens
635 tok

#110 Qwen3.6 Max Preview

none
Custo
$0.025
Tempo
83.9s
Tokens
4,066 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0

Comparação rápida

Trocar par de comparação