Navegação
Advertise here

Granite 4.2 8B vs KAT Coder AIR V2.5 (default)

A pontuação média está praticamente empatada em 4.4 vs 4.4. Granite 4.2 8B tem menor custo de benchmark com $0.037 vs $0.070. KAT Coder AIR V2.5 (default) é mais rápido com 11.96s vs 84.66s, com taxas de acerto de 15.9% vs 34.8%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#350
Total de tokens de saída
133,268
Tempo de resposta (médio)
84.66s
Custo total
$0.037
Posição
#348
Total de tokens de saída
97,752
Tempo de resposta (médio)
11.96s
Custo total
$0.070
Modelo recomendado KAT Coder AIR V2.5 (default)

Tem a melhor pontuação aqui (4.4) e responde cerca de 7.1x mais rápido que Granite 4.2 8B.

Comparação detalhada

Métrica Granite 4.2 8B Granite 4.2 8B none Lançamento: 2026-09-02 KAT Coder AIR V2.5 KAT Coder AIR V2.5 default Lançamento: 2026-07-14
Pontuação 4.4 4.4
Posição #350 #348
Confiabilidade 9.1 10.0
Consistência 9.3 7.4
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 15.9% 34.8%
Testes instáveis 2 7
Execuções totais 69 69
Custo por resultado 1.206 1.382
Custo total $0.037 $0.070
Preço de entrada $0.060 / 1M $0.150 / 1M
Preço de saída $0.250 / 1M $0.600 / 1M
Preço de leitura do cache $0.015 / 1M N/D
Preço de escrita no cache N/D N/D
Total de tokens de entrada 226,872 69,376
Tokens de saída 133,268 7,792
Tokens de raciocínio 0 89,960
Tempo de resposta (médio) 84.66s 11.96s
Tempo de resposta (máx.) 747.17s 121.05s
Tempo de resposta (total) 1947.17s 275.18s
Parâmetros 8B ~35B no total (~3B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#350 IBM: Granite 4.2 8B

none
Provider returned error
Custo
$0.000
Tempo
0.2s
Tokens
0 tok

#348 KAT Coder AIR V2.5

default
Custo
$0.002
Tempo
14.5s
Tokens
2,619 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0
KAT Coder AIR V2.5 3.3 9.6 0.0% 0 14.31s 6,472 2,032 14,886

Comparação rápida

Trocar par de comparação