Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Cobuddy (medium) vs Granite 4.2 8B

Cobuddy (medium) lidera na pontuação média com 4.7 vs 4.3. Cobuddy (medium) tem menor custo de benchmark com $0.000 vs $0.026. Cobuddy (medium) é mais rápido com 39.90s vs 86.27s, com taxas de acerto de 45.5% vs 16.7%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-09-02

Posição
#274
Total de tokens de saída
118,380
Tempo de resposta (médio)
39.90s
Custo total
$0.000
Posição
#285
Total de tokens de saída
130,805
Tempo de resposta (médio)
86.27s
Custo total
$0.026
Modelo recomendado Cobuddy (medium)

Tem a melhor pontuação aqui (4.7) e responde cerca de 2.2x mais rápido que Granite 4.2 8B.

Comparação detalhada

Métrica Cobuddy Cobuddy medium Lançamento: 2026-05-06 Granite 4.2 8B Granite 4.2 8B none Lançamento: 2026-09-02
Pontuação 4.7 4.3
Posição #274 #285
Confiabilidade 10.0 8.6
Consistência 7.2 9.3
Tentativas 63/66 66/66
Testes corretos
Taxa de acerto por tentativa 45.5% 16.7%
Testes instáveis 6 2
Execuções totais 63 66
Custo por resultado 0.000 0.847
Custo total $0.000 $0.026
Preço de entrada $0.000 / 1M $0.100 / 1M
Preço de saída $0.000 / 1M $0.150 / 1M
Total de tokens de entrada 37,449 57,786
Tokens de saída 1,677 130,805
Tokens de raciocínio 116,703 0
Tempo de resposta (médio) 39.90s 86.27s
Tempo de resposta (máx.) 309.02s 747.17s
Tempo de resposta (total) 797.98s 1897.96s
Parâmetros ~21B no total (~3B ativos) 8B
Disponibilidade Código fechado Código aberto

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Cobuddy

medium
No endpoints found for baidu/cobuddy:free.
Custo
$0.000
Tempo
0.1s
Tokens
0 tok

#285 IBM: Granite 4.2 8B

none
Provider returned error
Custo
$0.000
Tempo
0.2s
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Cobuddy 3.7 6.7 22.2% 1 79.17s 4,726 358 30,138
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0

Comparação rápida

Trocar par de comparação