Navegação
AI BENCHY
Advertise here

Laguna XS 2.1 (medium) vs Qwen3.5-27B

Qwen3.5-27B lidera na pontuação média com 6.6 vs 6.5. Qwen3.5-27B tem menor custo de benchmark com $0.058 vs $0.068. Qwen3.5-27B é mais rápido com 4.77s vs 48.18s, com taxas de acerto de 45.5% vs 45.5%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-29

Posição
#155
Total de tokens de saída
522,480
Tempo de resposta (médio)
48.18s
Custo total
$0.068
Posição
#148
Total de tokens de saída
24,323
Tempo de resposta (médio)
4.77s
Custo total
$0.058
Modelo recomendado Qwen3.5-27B

Tem a melhor pontuação aqui (6.6) e responde cerca de 10.1x mais rápido que Laguna XS 2.1 (medium).

Comparação detalhada

Métrica Laguna XS 2.1 Laguna XS 2.1 medium Lançamento: 2026-07-02 Disponível grátis Qwen3.5-27B Qwen3.5-27B none Lançamento: 2026-02-24
Pontuação 6.5 6.6
Posição #155 #148
Confiabilidade 10.0 10.0
Consistência 9.2 9.3
Tentativas 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 45.5% 45.5%
Testes instáveis 2 2
Execuções totais 66 66
Custo por resultado 0.745 0.678
Custo total $0.068 $0.058
Preço de entrada $0.060 / 1M $0.195 / 1M
Preço de saída $0.120 / 1M $1.560 / 1M
Total de tokens de entrada 118,998 102,325
Tokens de saída 30,750 24,323
Tokens de raciocínio 491,730 0
Tempo de resposta (médio) 48.18s 4.77s
Tempo de resposta (máx.) 422.72s 69.46s
Tempo de resposta (total) 1059.93s 105.00s
Parâmetros 33B no total (3B ativos) 27B
Disponibilidade Pesos disponíveis Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 Laguna XS 2.1

medium
Custo
$0.001
Tempo
30.6s
Tokens
4,678 tok

#148 Qwen3.5-27B

none
Custo
$0.007
Tempo
42.9s
Tokens
4,273 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258
Qwen3.5-27B 5.8 10.0 33.3% 0 1.80s 7,913 415 0

Comparação rápida

Trocar par de comparação