Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Laguna S 2.1 (low) vs Qwen3.5-9B

Qwen3.5-9B lidera na pontuação média com 5.1 vs 5.0. Qwen3.5-9B tem menor custo de benchmark com $0.021 vs $0.082. Qwen3.5-9B é mais rápido com 19.19s vs 85.34s, com taxas de acerto de 22.7% vs 19.7%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-09-04

Posição
#266
Total de tokens de saída
451,708
Tempo de resposta (médio)
85.34s
Custo total
$0.082
Posição
#261
Total de tokens de saída
37,484
Tempo de resposta (médio)
19.19s
Custo total
$0.021
Modelo recomendado Qwen3.5-9B

Tem a melhor pontuação aqui (5.1) e custa cerca de 4.1x menos que Laguna S 2.1 (low).

Comparação detalhada

Métrica Laguna S 2.1 Laguna S 2.1 low Lançamento: 2026-07-21 Disponível grátis Qwen3.5-9B Qwen3.5-9B none Lançamento: 2026-03-02
Pontuação 5.0 5.1
Posição #266 #261
Confiabilidade 10.0 10.0
Consistência 8.0 9.7
Tentativas 66/66 66/66
Testes corretos
Taxa de acerto por tentativa 22.7% 19.7%
Testes instáveis 5 1
Execuções totais 66 66
Custo por resultado 3.022 0.490
Custo total $0.082 $0.021
Preço de entrada $0.090 / 1M $0.100 / 1M
Preço de saída $0.180 / 1M $0.150 / 1M
Total de tokens de entrada 118,752 144,416
Tokens de saída 67,823 37,484
Tokens de raciocínio 383,885 0
Tempo de resposta (médio) 85.34s 19.19s
Tempo de resposta (máx.) 814.73s 382.06s
Tempo de resposta (total) 1877.49s 422.25s
Parâmetros 118B no total (8B ativos) 9B
Disponibilidade Pesos disponíveis Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Laguna S 2.1

low
Custo
$0.001
Tempo
6.6s
Tokens
1,314 tok

#261 Qwen3.5-9B

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Custo
$0.000
Tempo
300.0s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

Comparação rápida

Trocar par de comparação