- Posição
- #348
- Total de tokens de saída
- 97,752
- Tempo de resposta (médio)
- 11.96s
- Custo total
- $0.070
KAT Coder AIR V2.5 (default) vs gpt-oss-120b
KAT Coder AIR V2.5 (default) lidera na pontuação média com 4.4 vs 4.2. gpt-oss-120b tem menor custo de benchmark com $0.016 vs $0.070. KAT Coder AIR V2.5 (default) é mais rápido com 11.96s vs 28.63s, com taxas de acerto de 34.8% vs 34.8%.
Modelos comparados
- Posição
- #356
- Total de tokens de saída
- 62,213
- Tempo de resposta (médio)
- 28.63s
- Custo total
- $0.016
Modelo recomendado
KAT Coder AIR V2.5 (default)
Tem a melhor pontuação aqui (4.4) e responde cerca de 2.4x mais rápido que gpt-oss-120b.
Comparação detalhada
| Métrica | KAT Coder AIR V2.5 KAT Coder AIR V2.5 default | gpt-oss-120b gpt-oss-120b none |
|---|---|---|
| Pontuação | 4.4 | 4.2 |
| Posição | #348 | #356 |
| Confiabilidade | 10.0 | 10.0 |
| Consistência | 7.4 | 7.6 |
| Tentativas | 69/69 | 60/69 |
| Testes corretos | ||
| Taxa de acerto por tentativa | 34.8% | 34.8% |
| Testes instáveis | 7 | 3 |
| Execuções totais | 69 | 60 |
| Custo por resultado | 1.382 | 0.274 |
| Custo total | $0.070 | $0.016 |
| Preço de entrada | $0.150 / 1M | $0.037 / 1M |
| Preço de saída | $0.600 / 1M | $0.170 / 1M |
| Preço de leitura do cache | N/D | N/D |
| Preço de escrita no cache | N/D | N/D |
| Total de tokens de entrada | 69,376 | 131,652 |
| Tokens de saída | 7,792 | 16,869 |
| Tokens de raciocínio | 89,960 | 53,081 |
| Tempo de resposta (médio) | 11.96s | 28.63s |
| Tempo de resposta (máx.) | 121.05s | 140.90s |
| Tempo de resposta (total) | 275.18s | 486.69s |
| Parâmetros | ~35B no total (~3B ativos) | 117B no total (5.1B ativos) |
| Disponibilidade | Código fechado | Código aberto |
Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.
Geração showcase de modelos
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#348 KAT Coder AIR V2.5
default- Custo
- $0.002
- Tempo
- 14.5s
- Tokens
- 2,619 tok
#356 gpt-oss-120b
none
Nenhum resultado showcase foi gerado para este modelo ainda.
- Custo
- N/D
- Tempo
- -
- Tokens
- 0 tok
Melhores modelos por pontuação
Pontuação vs custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Tarefas de agentes | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 1.07s | 0 | 0 | 0 | |
| gpt-oss-120b | 6.1 | 3.1 | 66.7% | 1 | 140.90s | 122,571 | 145 | 10,404 |
| Truques anti-IA | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.3 | 5.6 | 50.0% | 2 | 2.68s | 672 | 686 | 2,358 | |
| gpt-oss-120b | 6.5 | 10.0 | 50.0% | 0 | 32.84s | 1,336 | 5,685 | 2,991 |
| Programação | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.3 | 9.6 | 0.0% | 0 | 14.31s | 6,472 | 2,032 | 14,886 | |
| gpt-oss-120b | 1.5 | 0.4 | 22.2% | 1 | 9.57s | 901 | 204 | 3,028 |
| Combinado | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.8 | 1.6 | 50.0% | 2 | 73.00s | 43,170 | 2,531 | 48,237 | |
| gpt-oss-120b | 1.5 | 5.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Análise e extração de dados | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 6.3 | 5.8 | 66.7% | 1 | 2.66s | 7,776 | 280 | 988 | |
| gpt-oss-120b | 6.5 | 10.0 | 50.0% | 0 | 7.12s | 2,421 | 149 | 449 |
| Específico do domínio | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 8.33s | 780 | 1,399 | 10,258 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 34.98s | 1,294 | 4,675 | 25,774 |
| Inteligência geral | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 5.0 | 10.0 | 0.0% | 0 | 12.02s | 516 | 141 | 515 | |
| gpt-oss-120b | 4.8 | 10.0 | 0.0% | 0 | 10.79s | 584 | 615 | 684 |
| Seguimento de instruções | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 9.9 | 10.0 | 100.0% | 0 | 1.75s | 699 | 90 | 768 | |
| gpt-oss-120b | 9.8 | 10.0 | 100.0% | 0 | 5.06s | 1,043 | 157 | 1,783 |
| Resolução de quebra-cabeças | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 2.9 | 4.4 | 22.2% | 2 | 1.84s | 696 | 284 | 971 | |
| gpt-oss-120b | 6.0 | 7.2 | 55.6% | 1 | 8.21s | 1,188 | 2,101 | 1,881 |
| Chamada de ferramentas | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 10.0 | 10.0 | 100.0% | 0 | 5.13s | 8,391 | 330 | 1,230 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Conhecimentos gerais | Pontuação | Consistência | Taxa de acerto por tentativa | Testes instáveis | Testes corretos | Tempo de resposta (médio) | Tokens de entrada | Tokens de saída | Tokens de raciocínio |
|---|---|---|---|---|---|---|---|---|---|
| KAT Coder AIR V2.5 | 3.0 | 10.0 | 0.0% | 0 | 17.96s | 204 | 19 | 9,749 | |
| gpt-oss-120b | 3.0 | 10.0 | 0.0% | 0 | 47.29s | 314 | 3,138 | 6,087 |
Comparação rápida
Trocar par de comparação
KAT Coder AIR V2.5defaultvsNemotron 3 SupernoneDisponível grátisGranite 4.2 8BnonevsKAT Coder AIR V2.5defaultgpt-oss-120bnonevsGLM 4.7 FlashmediumCobuddymediumDisponível grátisvsKAT Coder AIR V2.5defaultMercury 2nonevsKAT Coder AIR V2.5defaultMiniMax M2.5mediumvsgpt-oss-120bnonegpt-oss-120bnonevsQwen3.5-9BmediumKAT Coder AIR V2.5defaultvsNemotron 3.5 LightninglowDisponível grátisKAT Coder AIR V2.5defaultvsMiniMax M2.5mediumKAT Coder AIR V2.5defaultvsLaguna S 2.1lowDisponível grátisKAT Coder AIR V2.5defaultvsGPT-5.4 NanononeDeepSeek V3.2nonevsKAT Coder AIR V2.5default