- Posição
- #376
- Total de tokens de saída
- 28,061
- Tempo de resposta (médio)
- 5.63s
- Custo total
- $0.002
Kev 4B vs GLM 4.7 Flash (medium)
GLM 4.7 Flash (medium) lidera na pontuação média com 4.2 vs 2.4. Kev 4B tem menor custo de benchmark com $0.002 vs $0.193. Kev 4B é mais rápido com 5.63s vs 150.90s, com taxas de acerto de 15.9% vs 30.4%.
Modelos comparados
- Posição
- #341
- Total de tokens de saída
- 464,375
- Tempo de resposta (médio)
- 150.90s
- Custo total
- $0.193
Modelo recomendado
GLM 4.7 Flash (medium)
Tem a pontuação mais forte nesta comparação (4.2) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.
Comparação detalhada
| Métrica | Kev 4B Kev 4B none | GLM 4.7 Flash GLM 4.7 Flash medium |
|---|---|---|
| Pontuação | 2.4 | 4.2 |
| Posição | #376 | #341 |
| Confiabilidade | 10.0 | 9.4 |
| Consistência | 4.9 | 7.1 |
| Tentativas | 36/69 | 69/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 15.9% | 30.4% |
| Testes instáveis | 1 | 8 |
| Execuções totais | 36 | 69 |
| Custo por resultado | 0.060 | 4.822 |
| Custo total | $0.002 | $0.193 |
| Preço de entrada | $0.042 / 1M | $0.061 / 1M |
| Preço de saída | $0.000 / 1M | $0.400 / 1M |
| Preço de leitura do cache | N/D | N/D |
| Preço de escrita no cache | N/D | N/D |
| Total de tokens de entrada | 42,804 | 228,711 |
| Tokens de saída | 28,061 | 42,254 |
| Tokens de raciocínio | 0 | 422,121 |
| Tempo de resposta (médio) | 5.63s | 150.90s |
| Tempo de resposta (máx.) | 17.79s | 1539.97s |
| Tempo de resposta (total) | 67.61s | 2414.33s |
| Parâmetros | 4B | 30B no total (3B ativos) |
| Disponibilidade | Código aberto | Código aberto |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#376 Jared Palmer: Kev 4B
none
Nenhum resultado showcase foi gerado para este modelo ainda.
- Custo
- N/D
- Tempo
- -
- Tokens
- 0 tok
#341 GLM 4.7 Flash
medium
No output was saved. The original provider response or failure reason is unavailable.
- Custo
- $0.000
- Tempo
- 186.2s
- Tokens
- 12,112 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| GLM 4.7 Flash | 3.9 | 9.6 | 0.0% | 0 | 399.20s | 149,607 | 0 | 44,841 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 2.3 | 7.5 | 0.0% | 0 | 3.65s | 5,364 | 7,514 | 0 | |
| GLM 4.7 Flash | 4.7 | 5.9 | 41.7% | 2 | 14.95s | 555 | 1,122 | 6,110 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 4.5 | 6.7 | 33.3% | 0 | 771ms | 21,603 | 12,207 | 0 | |
| GLM 4.7 Flash | 3.2 | 7.4 | 11.1% | 1 | 55.33s | 3,106 | 4,981 | 22,387 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| GLM 4.7 Flash | 2.9 | 6.0 | 16.7% | 1 | 802.77s | 59,030 | 2,585 | 305,678 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 6.5 | 10.0 | 50.0% | 0 | 9.09s | 11,010 | 3,573 | 0 | |
| GLM 4.7 Flash | 6.3 | 10.0 | 50.0% | 0 | 1.51s | 7,107 | 584 | 2,755 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 5.3 | 10.0 | 33.3% | 0 | 6.34s | 2,178 | 1,905 | 0 | |
| GLM 4.7 Flash | 3.5 | 4.4 | 33.3% | 2 | 96.74s | 696 | 31,500 | 28,565 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| GLM 4.7 Flash | 3.6 | 9.7 | 0.0% | 0 | 18.14s | 318 | 18 | 2,138 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 1.5 | 5.0 | 0.0% | 0 | 17.27s | 2,316 | 2,688 | 0 | |
| GLM 4.7 Flash | 6.2 | 5.8 | 66.7% | 1 | 2.97s | 636 | 388 | 2,181 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 2.0 | 1.0 | 22.2% | 1 | 646ms | 333 | 174 | 0 | |
| GLM 4.7 Flash | 2.9 | 7.2 | 11.1% | 1 | 12.93s | 521 | 781 | 5,255 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| GLM 4.7 Flash | 10.0 | 10.0 | 100.0% | 0 | 15.95s | 6,949 | 224 | 1,014 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| Kev 4B | 0.0 | 0.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 | |
| GLM 4.7 Flash | 3.0 | 10.0 | 0.0% | 0 | 11.13s | 186 | 71 | 1,197 |
Comparação rápida
Trocar par de comparação
gpt-oss-120bnonevsGLM 4.7 FlashmediumMercury 2.5nonevsGLM 4.7 FlashmediumMercury 2nonevsGLM 4.7 FlashmediumGranite 4.2 8BnonevsGLM 4.7 FlashmediumTrinity Large PreviewnoneDisponível grátisvsGLM 4.7 FlashmediumKAT Coder AIR V2.5nonevsGLM 4.7 FlashmediumNemotron 3 SupernoneDisponível grátisvsGLM 4.7 FlashmediumRing 2.6 1tnonevsGLM 4.7 FlashmediumLing 2.6 FlashnonevsGLM 4.7 FlashmediumNemotron 3.5 LightninglowDisponível grátisvsGLM 4.7 FlashmediumLaguna S 2.1lowDisponível grátisvsGLM 4.7 FlashmediumLing 3.0 TinynonevsGLM 4.7 Flashmedium