Navegação
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kev 4B vs gpt-oss-120b

gpt-oss-120b lidera na pontuação média com 3.7 vs 3.0. Kev 4B tem menor custo de benchmark com $0.002 vs $0.033. Kev 4B é mais rápido com 5.63s vs 21.61s, com taxas de acerto de 16.7% vs 33.3%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-09-28

Modelos comparados

Posição
#366
Total de tokens de saída
28,061
Tempo de resposta (médio)
5.63s
Custo total
$0.002
Posição
#358
Total de tokens de saída
51,664
Tempo de resposta (médio)
21.61s
Custo total
$0.033
Modelo recomendado gpt-oss-120b

Tem a pontuação mais forte nesta comparação (3.7) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.

Comparação detalhada

Métrica Kev 4B Kev 4B none Lançamento: 2026-09-28 gpt-oss-120b gpt-oss-120b none Lançamento: 2025-08-05 Disponível grátis
Pontuação 3.0 3.7
Posição #366 #358
Confiabilidade 10.0 10.0
Consistência 5.1 7.8
Tentativas 36/66 57/66
Testes corretos
Taxa de acerto por tentativa 16.7% 33.3%
Testes instáveis 1 2
Execuções totais 36 57
Custo por resultado 0.060 0.168
Custo total $0.002 $0.033
Preço de entrada $0.042 / 1M $0.150 / 1M
Preço de saída $0.000 / 1M $0.600 / 1M
Total de tokens de entrada 42,804 9,081
Tokens de saída 28,061 51,664
Tokens de raciocínio 0 0
Tempo de resposta (médio) 5.63s 21.61s
Tempo de resposta (máx.) 17.79s 113.71s
Tempo de resposta (total) 67.61s 345.79s
Parâmetros 4B 117B no total (5.1B ativos)
Disponibilidade Código aberto Código aberto

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Kev 4B 4.5 6.7 33.3% 0 771ms 21,603 12,207 0
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Comparação rápida

Trocar par de comparação

Ling 3.0 Tinymediumvsgpt-oss-120bnoneDisponível grátisgpt-oss-120bnoneDisponível grátisvsQwen3.5-9BmediumCommand A+mediumvsKev 4BnoneCommand A+lowvsKev 4BnoneCommand A+highvsKev 4BnoneLing 3.0 Tinylowvsgpt-oss-120bnoneDisponível grátisLing 3.0 Tinyhighvsgpt-oss-120bnoneDisponível grátisgpt-oss-120bnoneDisponível grátisvsGLM 4.7 FlashmediumCommand A+highvsgpt-oss-120bnoneDisponível grátisCommand A+lowvsgpt-oss-120bnoneDisponível grátisCommand A+mediumvsgpt-oss-120bnoneDisponível grátisLing 3.0 TinymediumvsKev 4Bnone