Navegação
Advertise here

Kev 4B (default) vs GPT-6 Luna Decisions (default)

A pontuação média está praticamente empatada em 2.4 vs 2.4. Kev 4B (default) tem menor custo de benchmark com $0.002 vs $0.005. GPT-6 Luna Decisions (default) é mais rápido com 495ms vs 5.63s, com taxas de acerto de 15.9% vs 13.0%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#391
Total de tokens de saída
28,061
Tempo de resposta (médio)
5.63s
Custo total
$0.002
Posição
#390
Total de tokens de saída
0
Tempo de resposta (médio)
495ms
Custo total
$0.005
Modelo recomendado GPT-6 Luna Decisions (default)

Tem a melhor pontuação aqui (2.4) e responde cerca de 11.4x mais rápido que Kev 4B (default).

Comparação detalhada

Métrica Kev 4B Kev 4B default Lançamento: 2026-09-28 GPT-6 Luna Decisions GPT-6 Luna Decisions default Lançamento: 2026-10-07
Pontuação 2.4 2.4
Posição #391 #390
Confiabilidade 10.0 10.0
Consistência 4.9 5.2
Tentativas 36/69 36/69
Testes corretos
Taxa de acerto por tentativa 15.9% 13.0%
Testes instáveis 1 0
Execuções totais 36 36
Custo por resultado 0.060 0.159
Custo total $0.002 $0.005
Preço de entrada $0.042 / 1M $0.100 / 1M
Preço de saída $0.000 / 1M $0.000 / 1M
Preço de leitura do cache N/D $0.000 / 1M
Preço de escrita no cache N/D $0.000 / 1M
Total de tokens de entrada 42,804 47,583
Tokens de saída 28,061 0
Tokens de raciocínio 0 0
Tempo de resposta (médio) 5.63s 495ms
Tempo de resposta (máx.) 17.79s 842ms
Tempo de resposta (total) 67.61s 5.94s
Parâmetros 4B ~400B no total (~17B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
GPT-6 Luna Decisions 2.5 6.7 0.0% 0 447ms 22,197 0 0

Comparação rápida

Trocar par de comparação

Command A+lowvsGPT-6 Luna DecisionsdefaultCommand A+lowvsKev 4BdefaultCommand A+nonevsGPT-6 Luna DecisionsdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultGemini 3 Flash PreviewhighvsGPT-6 Luna DecisionsdefaultCommand A+highvsGPT-6 Luna DecisionsdefaultCommand A+highvsKev 4BdefaultCommand A+mediumvsGPT-6 Luna DecisionsdefaultGPT-6 Luna DecisionsdefaultvsGrok 4.20noneCommand A+mediumvsKev 4BdefaultKev 4BdefaultvsGrok 4.20none