AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#359

Claude Opus 5.5

Anthropic Lançamento: 2026-09-23 Testado em: 2026-09-23 01:51 anthropic/claude-opus-5.5::none
~5T no total (~500B ativos)MoECódigo fechadoEstimado

Resumo

Claude Opus 5.5 marca 1.8 no AI BENCHY e fica em #359. Tem fiabilidade 10.0, taxa de acerto de 4.6%, custo total de $0.015 e tempo médio de resposta de 13.58s.

O que torna Claude Opus 5.5 único: O custo total do benchmark é invulgarmente baixo para este nível de pontuação.

Modelo arquivado: este modelo não é mais atualizado nem testado em novos testes.

Dados do modelo

Pesquisado em 2026-09-23

Estimado
Parâmetros
~5T no total (~500B ativos)
Arquitetura
MoE
Disponibilidade
Código fechado
Licença
-

Melhor estimativa com base em evidências públicas; o fornecedor não divulgou todos os valores.

Consistência

5.0

Total de tokens de saída

735

Total de tokens de entrada

73

Preço de entrada

$4.000 / 1M

Preço de saída

$20.000 / 1M

Testes corretos

Testes errados: 0

Taxa de acerto por tentativa: 4.6%

Testes instáveis

0

Testes instáveis tiveram resultados mistos entre execuções (pelo menos um acerto e uma falha).

Tempo de resposta (médio)

13.58s

Tempo de resposta (máx.): 13.58s

Tempo de resposta (total): 13.58s

Gráficos

Escolha o primeiro modelo e depois clique em um segundo modelo para abrir uma página lado a lado.

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Categoria Pontuação Consistência Testes corretos
Truques anti-IA 0.0 0.0
Programação 0.0 0.0
Combinado 0.0 0.0
Análise e extração de dados 0.0 0.0
Específico do domínio 3.3 3.3
Inteligência geral 0.0 0.0
Seguimento de instruções 0.0 0.0
Resolução de quebra-cabeças 0.0 0.0
Chamada de ferramentas 0.0 0.0
Conhecimentos gerais 0.0 0.0

Modelos comparados