Navegação
Advertise here

Command A+ (medium) vs Decider V1.1 27B (default)

Command A+ (medium) lidera na pontuação média com 3.4 vs 2.6. Decider V1.1 27B (default) tem menor custo de benchmark com $0.002 vs $0.064. Decider V1.1 27B (default) é mais rápido com 320ms vs 91.72s, com taxas de acerto de 0.0% vs 17.4%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#382
Total de tokens de saída
18,795
Tempo de resposta (médio)
91.72s
Custo total
$0.064
Posição
#395
Total de tokens de saída
69
Tempo de resposta (médio)
320ms
Custo total
$0.002
Modelo recomendado Decider V1.1 27B (default)

Oferece o melhor compromisso geral: pontuação competitiva (2.6), custo menor que Command A+ (medium) e tempo de resposta equilibrado.

Comparação detalhada

Métrica Command A+ Command A+ medium Lançamento: 2026-09-23 Decider V1.1 27B Decider V1.1 27B default Lançamento: 2026-10-07
Pontuação 3.4 2.6
Posição #382 #395
Confiabilidade 3.5 10.0
Consistência 10.0 5.2
Tentativas 69/69 36/69
Testes corretos
Taxa de acerto por tentativa 0.0% 17.4%
Testes instáveis 0 0
Execuções totais 69 36
Custo por resultado 0.000 0.037
Custo total $0.064 $0.002
Preço de entrada $0.300 / 1M $0.020 / 1M
Preço de saída $1.500 / 1M $0.000 / 1M
Preço de leitura do cache $0.150 / 1M N/D
Preço de escrita no cache N/D N/D
Total de tokens de entrada 118,771 73,557
Tokens de saída 4,127 69
Tokens de raciocínio 14,668 0
Tempo de resposta (médio) 91.72s 320ms
Tempo de resposta (máx.) 112.76s 491ms
Tempo de resposta (total) 2109.54s 3.84s
Parâmetros 218B no total (25B ativos) 27B
Disponibilidade Código aberto Código aberto

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#382 Command A+

medium
Provider returned error
Custo
$0.000
Tempo
0.2s
Tokens
0 tok

#395 Decider V1.1 27B

default
Nenhum resultado showcase foi gerado para este modelo ainda.
Custo
N/D
Tempo
-
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Command A+ 3.0 10.0 0.0% 0 93.13s 0 0 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Trocar par de comparação

Command A+mediumvsGrok 4.20noneCommand A+mediumvsLing 3.0 TinylowCommand A+mediumvsLing 3.0 TinyhighCommand A+lowvsDecider V1.1 27BdefaultCommand A+mediumvsNemotron 3.5 LightningnoneDisponível grátisCommand A+mediumvsGranite 4.1 8bdefaultCommand A+nonevsDecider V1.1 27BdefaultCommand A+mediumvsLing 3.0 TinydefaultCommand A+highvsDecider V1.1 27BdefaultGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+mediumvsMercury 2.5noneCommand A+mediumvsJev 1.13default