Navegação
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Modelos comparados

Comparação benchmark Qwen3.8 27B (low) vs Qwen3.8 Flash Next (low) vs Qwen3.8 27B (high) vs Qwen3.8 Flash Next (xhigh): Qwen3.8 27B (high) lidera em Pontuação com 8.7. Qwen3.8 27B (low) lidera em Confiabilidade com 10.0. Qwen3.8 Flash Next (low) tem o menor Custo total em ~$0.045. Qwen3.8 Flash Next (low) é o mais rápido com 23.66s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-05

Modelos comparados

Posição
#121
Total de tokens de saída
209,143
Tempo de resposta (médio)
46.60s
Custo total
~$0.089
Posição
#96
Total de tokens de saída
135,295
Tempo de resposta (médio)
23.66s
Custo total
~$0.045
Posição
#55
Total de tokens de saída
677,080
Tempo de resposta (médio)
166.34s
Custo total
~$0.298
Posição
#154
Total de tokens de saída
621,056
Tempo de resposta (médio)
102.66s
Custo total
~$0.195
Modelo recomendado Qwen3.8 Flash Next (low)

A pontuação fica perto da melhor aqui (8.0 vs 8.7) e custa cerca de 4.3x menos que os outros modelos nesta comparação.

Comparação detalhada

Métrica Qwen3.8 27B Qwen3.8 27B low Lançamento: 2026-08-14 Disponível grátis Qwen3.8 Flash Next Qwen3.8 Flash Next low Lançamento: 2026-10-04 Qwen3.8 27B Qwen3.8 27B high Lançamento: 2026-08-14 Disponível grátis Qwen3.8 Flash Next Qwen3.8 Flash Next xhigh Lançamento: 2026-10-04
Pontuação 7.6 8.0 8.7 7.1
Posição #121 #96 #55 #154
Confiabilidade 10.0 10.0 9.7 9.9
Consistência 9.7 8.0 9.2 7.9
Tentativas 69/69 69/69 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 68.1% 79.7% 78.3% 72.5%
Testes instáveis 1 6 2 6
Execuções totais 69 69 69 69
Custo por resultado ~0.589 ~0.299 ~1.751 ~1.390
Custo total ~$0.089 ~$0.045 ~$0.298 ~$0.195
Preço de entrada N/D N/D N/D N/D
Preço de saída N/D N/D N/D N/D
Preço de leitura do cache N/D N/D N/D N/D
Preço de escrita no cache N/D N/D N/D N/D
Total de tokens de entrada 315,290 342,163 348,967 301,749
Tokens de saída 1,607 1,518 1,005 1,033
Tokens de raciocínio 207,536 133,777 676,075 620,023
Tempo de resposta (médio) 46.60s 23.66s 166.34s 102.66s
Tempo de resposta (máx.) 376.04s 166.72s 640.85s 674.08s
Tempo de resposta (total) 1071.83s 544.16s 3825.81s 2361.10s
Parâmetros 27.3B 180B no total (6B ativos) 27.3B 180B no total (6B ativos)
Disponibilidade Pesos disponíveis Pesos disponíveis Pesos disponíveis Pesos disponíveis

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#121 Qwen3.8 27B

low
Custo
~$0.003
Tempo
92.8s
Tokens
6,902 tok

#96 Qwen3.8 Flash Next

low
Custo
~$0.002
Tempo
47.2s
Tokens
5,270 tok

#55 Qwen3.8 27B

high
Custo
~$0.008
Tempo
270.1s
Tokens
18,963 tok

#154 Qwen3.8 Flash Next

xhigh
Custo
~$0.010
Tempo
333.1s
Tokens
30,654 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Qwen3.8 27B 7.7 10.0 66.7% 0 140.92s 8,127 585 86,694
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335
Qwen3.8 Flash Next 7.4 7.0 77.8% 1 192.20s 8,235 122 186,070

Comparação rápida

Trocar par de comparação

GPT-5.2mediumvsQwen3.8 27BhighDisponível grátisQwen3.8 27BhighDisponível grátisvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighDisponível grátisGemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowGPT-6 SollowvsQwen3.8 27BhighDisponível grátisQwen3.8 27BlowDisponível grátisvsSpace Bunny AlphahighQwen3.8 27BlowDisponível grátisvsGLM 5.1mediumQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxQwen3.8 Flash NextxhighvsGLM 5.3 FlashXmediumClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumDisponível grátisvsQwen3.8 Flash Nextlow