A Anthropic lançou o Claude Opus 5.5 a 22 de setembro, o primeiro modelo da família Claude 5.5. A redução de preço é relevante, mas para equipas que executam agentes há uma segunda mudança igualmente importante: a empresa afirma que o modelo precisa de menos tokens para muitas tarefas longas e algumas solicitações sensíveis podem ser encaminhadas, de forma transparente, para outro modelo devido aos mecanismos de proteção.

O Opus 5.5 custa 4 dólares por milhão de tokens de entrada e 20 dólares por milhão de tokens de saída. As leituras de cache custam 0,20 dólares por milhão de tokens. A Anthropic diz que estes valores são 20% inferiores aos do Opus 5 e que, considerando também a redução do número de tokens usados por tarefa, o custo típico de trabalhos faturados por tokens cai cerca de 40%. O modo rápido custa 8 dólares por milhão de tokens de entrada e 40 dólares por milhão de tokens de saída.

O custo de uma tarefa aceite é a métrica que interessa

Para um agente de programação, o preço por token mostra apenas uma parte da conta. Um modelo que precise de menos passos, menos chamadas a ferramentas e menos saída pode gerar uma poupança superior à diferença nominal de preços. Por outro lado, mais repetições ou resultados intermédios que não passam na revisão podem anular essa vantagem.

A Anthropic afirma que o Opus 5.5 reduz em cerca de 40% o custo de cargas de trabalho típicas face ao Opus 5 e produz saída mais de 30% mais depressa. Os benchmarks e avaliações de clientes publicados no lançamento apontam na mesma direção, mas continuam a ser resultados da empresa ou de parceiros iniciais, não uma garantia de desempenho em qualquer aplicação.

Uma avaliação útil deve manter iguais as ferramentas, permissões, instruções e critérios de aceitação. Depois, deve medir custo por tarefa aceite, tempo total, número de chamadas a ferramentas, repetições e esforço de revisão humana.

Os mecanismos de proteção podem mudar o percurso da execução

O detalhe de arquitetura mais relevante deste lançamento é o encaminhamento associado aos mecanismos de proteção. A Anthropic aplica ao Opus 5.5 salvaguardas semelhantes às do Fable 5.1 em áreas como cibersegurança, biologia e riscos ligados à destilação. A empresa afirma que a maioria das tarefas de cibersegurança é encaminhada de forma transparente para o Claude Opus 4.8, existindo programas de acesso alargado para profissionais verificados.

Isto significa que o modelo pedido pela aplicação pode não ser o modelo que conclui todas as solicitações. Numa utilização comum, a diferença pode ser invisível. Em benchmarks, auditorias, ambientes regulados ou análise de incidentes, torna-se relevante.

A análise da Aipolix é que as equipas devem registar, sempre que a plataforma disponibilize essa informação, não apenas o modelo solicitado, a latência e o consumo de tokens, mas também o resultado do encaminhamento ou de uma intervenção de segurança. Caso contrário, uma avaliação pode misturar vários percursos de execução e atribuir tudo ao mesmo nome de modelo.

O preserved thinking altera algumas hipóteses de integração

O Opus 5.5 inclui também o mecanismo preserved thinking para contas API mais recentes. A Anthropic apresenta-o como uma proteção contra tentativas de destilação e afirma que impede clientes da API de alterarem livremente o contexto de raciocínio anterior de Claude. A medida aplica-se ao Opus 5.5 e ao Fable 5.1 em contas criadas a partir de 31 de agosto de 2026.

Para os programadores, a consequência é prática: o estado duradouro do workflow não deve depender da possibilidade de editar o raciocínio interno do modelo. A aplicação deve guardar o seu estado em dados explícitos, resultados de ferramentas e mensagens observáveis.

A Anthropic diz ainda que o Opus 5.5 continua disponível com retenção zero de dados e inclui medidas de marca de água destinadas ao cumprimento do AI Act europeu.

Agentes de longa duração beneficiam mais da nova estrutura de preços

A redução do preço das leituras de cache é particularmente importante em sessões prolongadas. O valor passa de 0,50 dólares por milhão de tokens no Opus 5 para 0,20 dólares no Opus 5.5. Agentes que reutilizam repetidamente um contexto grande de código ou documentos podem sentir uma diferença relevante.

Isto não elimina a necessidade de boa orquestração. Limites de permissões, controlos de ferramentas, pontos de recuperação, avaliação e tratamento de falhas continuam necessários. O que muda é o limiar económico para usar um modelo de topo numa tarefa longa.

O que medir antes de transferir produção

Uma implementação gradual deve comparar o Opus 5.5 com o modelo já usado em tarefas representativas. Convém acompanhar taxa de sucesso, chamadas a ferramentas, tokens de saída e cache, tempo total, intervenções dos mecanismos de proteção e carga de revisão humana.

O Opus 5.5 é relevante porque altera simultaneamente preço e, em certos pedidos, o percurso de execução. O preço mais baixo é imediato; o custo inferior de um resultado fiável ainda precisa de ser demonstrado em cada sistema.

Sources
- Anthropic — Introducing Claude Opus 5.5
- Anthropic — Claude Opus availability and pricing