Navegação
Advertise here

GPT-6 Luna Decisions (default) vs Decider V1.1 27B (default)

Decider V1.1 27B (default) lidera na pontuação média com 2.6 vs 2.4. Decider V1.1 27B (default) tem menor custo de benchmark com $0.002 vs $0.005. Decider V1.1 27B (default) é mais rápido com 320ms vs 495ms, com taxas de acerto de 13.0% vs 17.4%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#396
Total de tokens de saída
0
Tempo de resposta (médio)
495ms
Custo total
$0.005
Posição
#395
Total de tokens de saída
69
Tempo de resposta (médio)
320ms
Custo total
$0.002
Modelo recomendado Decider V1.1 27B (default)

Tem a melhor pontuação aqui (2.6) e custa cerca de 3.2x menos que GPT-6 Luna Decisions (default).

Comparação detalhada

Métrica GPT-6 Luna Decisions GPT-6 Luna Decisions default Lançamento: 2026-10-07 Decider V1.1 27B Decider V1.1 27B default Lançamento: 2026-10-07
Pontuação 2.4 2.6
Posição #396 #395
Confiabilidade 10.0 10.0
Consistência 5.2 5.2
Tentativas 36/69 36/69
Testes corretos
Taxa de acerto por tentativa 13.0% 17.4%
Testes instáveis 0 0
Execuções totais 36 36
Custo por resultado 0.159 0.037
Custo total $0.005 $0.002
Preço de entrada $0.100 / 1M $0.020 / 1M
Preço de saída $0.000 / 1M $0.000 / 1M
Preço de leitura do cache $0.000 / 1M N/D
Preço de escrita no cache $0.000 / 1M N/D
Total de tokens de entrada 47,583 73,557
Tokens de saída 0 69
Tokens de raciocínio 0 0
Tempo de resposta (médio) 495ms 320ms
Tempo de resposta (máx.) 842ms 491ms
Tempo de resposta (total) 5.94s 3.84s
Parâmetros ~400B no total (~17B ativos) 27B
Disponibilidade Código fechado Código aberto

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0
Decider V1.1 27B 4.9 6.7 33.3% 0 305ms 32,733 12 0

Trocar par de comparação

Command A+lowvsDecider V1.1 27BdefaultCommand A+nonevsDecider V1.1 27BdefaultCommand A+lowvsGPT-6 Luna DecisionsdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsDecider V1.1 27BdefaultGemini 3 Flash PreviewhighvsDecider V1.1 27BdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+mediumvsDecider V1.1 27BdefaultDecider V1.1 27BdefaultvsGrok 4.20noneCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20none