- Posição
- #391
- Total de tokens de saída
- 28,061
- Tempo de resposta (médio)
- 5.63s
- Custo total
- $0.002
Kev 4B (default) vs Grok 4.20
Grok 4.20 lidera na pontuação média com 3.4 vs 2.4. Kev 4B (default) tem menor custo de benchmark com $0.002 vs $0.057. Grok 4.20 é mais rápido com 1.11s vs 5.63s, com taxas de acerto de 15.9% vs 26.1%.
Modelos comparados
- Posição
- #376
- Total de tokens de saída
- 1,923
- Tempo de resposta (médio)
- 1.11s
- Custo total
- $0.057
Modelo recomendado
Grok 4.20
Tem a melhor pontuação aqui (3.4) e responde cerca de 5.1x mais rápido que Kev 4B (default).
Comparação detalhada
| Métrica | Kev 4B Kev 4B default | Grok 4.20 Grok 4.20 none |
|---|---|---|
| Pontuação | 2.4 | 3.4 |
| Posição | #391 | #376 |
| Confiabilidade | 10.0 | N/D |
| Consistência | 4.9 | 7.8 |
| Tentativas | 36/69 | 54/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 15.9% | 26.1% |
| Testes instáveis | 1 | 0 |
| Execuções totais | 36 | 54 |
| Custo por resultado | 0.060 | 1.570 |
| Custo total | $0.002 | $0.057 |
| Preço de entrada | $0.042 / 1M | $1.250 / 1M |
| Preço de saída | $0.000 / 1M | $2.500 / 1M |
| Preço de leitura do cache | N/D | $0.200 / 1M |
| Preço de escrita no cache | N/D | N/D |
| Total de tokens de entrada | 42,804 | 41,313 |
| Tokens de saída | 28,061 | 1,923 |
| Tokens de raciocínio | 0 | 0 |
| Tempo de resposta (médio) | 5.63s | 1.11s |
| Tempo de resposta (máx.) | 17.79s | 6.04s |
| Tempo de resposta (total) | 67.61s | 19.96s |
| Parâmetros | 4B | ~1T no total (~100B ativos) |
| Disponibilidade | Código aberto | Código fechado |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#391 Jared Palmer: Kev 4B
default
Nenhum resultado showcase foi gerado para este modelo ainda.
- Custo
- N/D
- Tempo
- -
- Tokens
- 0 tok
#376 xAI: Grok 4.20
none- Custo
- $0.004
- Tempo
- 6.5s
- Tokens
- 1,367 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
Comparação rápida
Trocar par de comparação
Command A+mediumvsGrok 4.20noneCommand A+highvsGrok 4.20noneLing 3.0 TinymediumvsGrok 4.20noneLing 3.0 TinylowvsGrok 4.20noneLing 3.0 TinyhighvsGrok 4.20noneCommand A+lowvsGrok 4.20noneGranite 4.1 8bdefaultvsGrok 4.20noneLing 3.0 TinydefaultvsGrok 4.20noneCommand A+lowvsKev 4BdefaultCommand A+nonevsKev 4BdefaultGemini 3 Flash PreviewhighvsKev 4BdefaultQwen3.5-9BmediumvsGrok 4.20none