Navegação
AI BENCHY
Advertise here

Modelos comparados

Comparação benchmark Qwen3.8 27B (high) vs Qwen3.8 27B (medium) vs Qwen3.8 27B (low) vs Qwen3.8 27B: Qwen3.8 27B (high) lidera em Pontuação com 8.4. Qwen3.8 27B (low) lidera em Confiabilidade com 10.0. Qwen3.8 27B tem o menor Custo total em ~$0.006. Qwen3.8 27B é o mais rápido com 3.12s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-15

Posição
#42
Total de tokens de saída
656,635
Tempo de resposta (médio)
167.89s
Custo total
~$0.287
Posição
#68
Total de tokens de saída
136,162
Tempo de resposta (médio)
33.05s
Custo total
~$0.058
Posição
#61
Total de tokens de saída
169,329
Tempo de resposta (médio)
39.11s
Custo total
~$0.071
Posição
#214
Total de tokens de saída
11,445
Tempo de resposta (médio)
3.12s
Custo total
~$0.006
Modelo recomendado Qwen3.8 27B

Oferece o melhor compromisso geral: pontuação competitiva (5.5), custo menor que os outros modelos nesta comparação e tempo de resposta equilibrado.

Comparação detalhada

Métrica Qwen3.8 27B Qwen3.8 27B high Lançamento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B medium Lançamento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B low Lançamento: 2026-08-14 Qwen3.8 27B Qwen3.8 27B none Lançamento: 2026-08-14
Pontuação 8.4 7.8 7.9 5.5
Posição #42 #68 #61 #214
Confiabilidade 9.6 9.6 10.0 10.0
Consistência 9.2 9.7 10.0 10.0
Tentativas 66/66 66/66 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 77.3% 66.7% 68.2% 40.9%
Testes instáveis 2 1 0 0
Execuções totais 66 66 66 66
Custo por resultado ~1.792 ~0.409 ~0.473 ~0.063
Custo total ~$0.287 ~$0.058 ~$0.071 ~$0.006
Preço de entrada N/D N/D N/D N/D
Preço de saída N/D N/D N/D N/D
Total de tokens de entrada 100,179 98,266 99,705 122,463
Tokens de saída 904 1,861 1,545 11,445
Tokens de raciocínio 655,731 134,301 167,784 0
Tempo de resposta (médio) 167.89s 33.05s 39.11s 3.12s
Tempo de resposta (máx.) 640.85s 214.63s 376.04s 44.76s
Tempo de resposta (total) 3693.54s 694.04s 860.51s 68.69s
Parâmetros 27.3B 27.3B 27.3B 27.3B
Disponibilidade Pesos disponíveis Pesos disponíveis Pesos disponíveis Pesos disponíveis

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 Qwen3.8 27B

high
Custo
~$0.008
Tempo
270.1s
Tokens
18,963 tok

#68 Qwen3.8 27B

medium
Custo
~$0.002
Tempo
43.4s
Tokens
2,956 tok

#61 Qwen3.8 27B

low
Custo
~$0.003
Tempo
92.8s
Tokens
6,902 tok

#214 Qwen3.8 27B

none
Custo
~$0.001
Tempo
23.9s
Tokens
1,922 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 27B 5.5 10.0 33.3% 0 1.19s 7,911 408 0

Comparação rápida

Trocar par de comparação

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowQwen3.8 27BlowvsStep 3.7 FlashmediumGPT-5.2 ChatnonevsQwen3.8 27BlowClaude Opus 4.8lowvsQwen3.8 27BmediumKimi K3maxvsQwen3.8 27BlowNemotron 3.5 LightninghighDisponível grátisvsQwen3.8 27BnoneKAT-Coder-Air V2.5mediumvsQwen3.8 27BnoneQwen3.8 27BhighvsGrok 4.6mediumGPT-5.6 TerrahighvsQwen3.8 27BlowSeed-2.0-CodelowvsQwen3.8 27Bmedium