Navegação
Advertise here

Command A+ (high) vs Kev 4B

A pontuação média está praticamente empatada em 3.0 vs 3.0. Command A+ (high) tem menor custo de benchmark com $0.000 vs $0.002. Kev 4B é mais rápido com 5.63s vs 86.95s, com taxas de acerto de 0.0% vs 16.7%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-09-28

Modelos comparados

Posição
#362
Total de tokens de saída
0
Tempo de resposta (médio)
86.95s
Custo total
$0.000
Posição
#366
Total de tokens de saída
28,061
Tempo de resposta (médio)
5.63s
Custo total
$0.002
Modelo recomendado Kev 4B

Tem a melhor pontuação aqui (3.0) e responde cerca de 15.4x mais rápido que Command A+ (high).

Comparação detalhada

Métrica Command A+ Command A+ high Lançamento: 2026-09-23 Kev 4B Kev 4B none Lançamento: 2026-09-28
Pontuação 3.0 3.0
Posição #362 #366
Confiabilidade 0.0 10.0
Consistência 10.0 5.1
Tentativas 66/66 36/66
Testes corretos
Taxa de acerto por tentativa 0.0% 16.7%
Testes instáveis 0 1
Execuções totais 66 36
Custo por resultado 0.000 0.060
Custo total $0.000 $0.002
Preço de entrada $0.300 / 1M $0.042 / 1M
Preço de saída $1.500 / 1M $0.000 / 1M
Total de tokens de entrada 0 42,804
Tokens de saída 0 28,061
Tokens de raciocínio 0 0
Tempo de resposta (médio) 86.95s 5.63s
Tempo de resposta (máx.) 114.87s 17.79s
Tempo de resposta (total) 1913.01s 67.61s
Parâmetros 218B no total (25B ativos) 4B
Disponibilidade Código aberto Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#362 Command A+

high
Provider returned error
Custo
$0.000
Tempo
0.2s
Tokens
0 tok

#366 Jared Palmer: Kev 4B

none
Nenhum resultado showcase foi gerado para este modelo ainda.
Custo
N/D
Tempo
-
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Command A+ 3.0 10.0 0.0% 0 92.74s 0 0 0
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0

Comparação rápida

Trocar par de comparação

Command A+mediumvsKev 4BnoneCommand A+lowvsKev 4BnoneCommand A+highvsJev 1.13noneCommand A+highvsgpt-oss-120bnoneDisponível grátisCommand A+highvsLing 3.0 TinymediumCommand A+highvsQwen3.5-9BmediumLing 3.0 TinymediumvsKev 4BnoneCommand A+highvsLing 3.0 TinylowKev 4BnonevsQwen3.5-9BmediumLing 3.0 TinylowvsKev 4BnoneLing 3.0 TinyhighvsKev 4BnoneCommand A+highvsMercury 2.5none