Resumo
Claude Opus 5.5 marca 1.8 no AI BENCHY e fica em #359. Tem fiabilidade 10.0, taxa de acerto de 4.6%, custo total de $0.015 e tempo médio de resposta de 13.58s.
O que torna Claude Opus 5.5 único: O custo total do benchmark é invulgarmente baixo para este nível de pontuação.
Modelo arquivado: este modelo não é mais atualizado nem testado em novos testes.
Dados do modelo
Pesquisado em 2026-09-23
- Parâmetros
- ~5T no total (~500B ativos)
- Arquitetura
- MoE
- Disponibilidade
- Código fechado
- Licença
- -
Melhor estimativa com base em evidências públicas; o fornecedor não divulgou todos os valores.
1.8
Consistência
5.0
10.0
$0.015
Total de tokens de saída
735
Total de tokens de entrada
73
Preço de entrada
$4.000 / 1M
Preço de saída
$20.000 / 1M
Testes instáveis
0
Testes instáveis tiveram resultados mistos entre execuções (pelo menos um acerto e uma falha).
Gráficos
Escolha o primeiro modelo e depois clique em um segundo modelo para abrir uma página lado a lado.
Pontuação vs Custo total
Tempo de resposta (médio)
Pontuação vs Tempo de resposta (médio)
Total de tokens de saída
Pontuação vs Total de tokens de saída
Detalhamento por categoria
| Categoria | Pontuação | Consistência | Testes corretos |
|---|---|---|---|
| Truques anti-IA | 0.0 | 0.0 | |
| Programação | 0.0 | 0.0 | |
| Combinado | 0.0 | 0.0 | |
| Análise e extração de dados | 0.0 | 0.0 | |
| Específico do domínio | 3.3 | 3.3 | |
| Inteligência geral | 0.0 | 0.0 | |
| Seguimento de instruções | 0.0 | 0.0 | |
| Resolução de quebra-cabeças | 0.0 | 0.0 | |
| Chamada de ferramentas | 0.0 | 0.0 | |
| Conhecimentos gerais | 0.0 | 0.0 |