Navegação
Advertise here

Dots 3 Note Preview vs KAT Coder AIR V2.5 (medium)

KAT Coder AIR V2.5 (medium) lidera na pontuação média com 5.1 vs 5.0. Dots 3 Note Preview tem menor custo de benchmark com $0.000 vs $0.048. Dots 3 Note Preview é mais rápido com 5.36s vs 8.32s, com taxas de acerto de 15.9% vs 43.5%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-02

Modelos comparados

Posição
#303
Total de tokens de saída
22,507
Tempo de resposta (médio)
5.36s
Custo total
$0.000
Posição
#297
Total de tokens de saída
66,576
Tempo de resposta (médio)
8.32s
Custo total
$0.048
Modelo recomendado KAT Coder AIR V2.5 (medium)

Tem a pontuação mais forte nesta comparação (5.1) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.

Comparação detalhada

Métrica Dots 3 Note Preview Dots 3 Note Preview none Lançamento: 2026-08-14 Disponível grátis KAT Coder AIR V2.5 KAT Coder AIR V2.5 medium Lançamento: 2026-07-14
Pontuação 5.0 5.1
Posição #303 #297
Confiabilidade 10.0 9.6
Consistência 9.7 8.9
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 15.9% 43.5%
Testes instáveis 1 3
Execuções totais 69 69
Custo por resultado 0.000 0.596
Custo total $0.000 $0.048
Preço de entrada $0.000 / 1M $0.150 / 1M
Preço de saída $0.000 / 1M $0.600 / 1M
Preço de leitura do cache N/D N/D
Preço de escrita no cache N/D N/D
Total de tokens de entrada 225,907 51,369
Tokens de saída 22,507 8,008
Tokens de raciocínio 0 58,568
Tempo de resposta (médio) 5.36s 8.32s
Tempo de resposta (máx.) 45.71s 48.19s
Tempo de resposta (total) 123.38s 191.40s
Parâmetros 280B no total (16B ativos) ~35B no total (~3B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#303 Dots 3 Note Preview

none
Custo
$0.000
Tempo
88.3s
Tokens
10,531 tok

#297 KAT Coder AIR V2.5

medium
Custo
$0.003
Tempo
23.7s
Tokens
4,924 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Dots 3 Note Preview 4.6 7.9 22.2% 1 6.12s 7,413 6,390 0
KAT Coder AIR V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973

Comparação rápida

Trocar par de comparação