Skip to content

Claude Opus 5.5 chega ao Microsoft Foundry com tokens mais baratos e relatórios de agente mais claros

Resposta curta

O Claude Opus 5.5, da Anthropic, agora está disponível de forma geral no Microsoft Foundry, hospedado no Azure, custando US$ 4/milhão de tokens de entrada e US$ 20/milhão de saída, com leituras de cache bem mais baratas. O modelo traz raciocínio adaptativo e relatórios mais claros, passo a passo, para agentes de codificação e trabalho de conhecimento de longa duração, além de ferramentas beta de gestão de contexto para sessões estendidas.

O que isso significa na operação

Para uma empresa B2B de 10 a 200 pessoas que roda agentes no Microsoft Foundry para redigir relatórios, triar chamados de suporte ou refatorar ferramentas internas, a mudança prática é dupla: custos menores de cache e de token tornam sessões de agente mais longas mais baratas de rodar em produção, e o novo hábito do modelo de expor o que fez, o que encontrou e onde precisa de input reduz a revisão manual necessária antes de confiar na saída de um agente. O raciocínio adaptativo também elimina uma etapa de configuração — as equipes não precisam mais ajustar manualmente o orçamento de raciocínio por tarefa, o que importa para times de operações enxutos sem engenheiros de IA dedicados.

O Claude Opus 5.5, da Anthropic, agora está disponível de forma geral no Microsoft Foundry, hospedado no Azure, dando a desenvolvedores e empresas acesso ao modelo Opus mais capaz da Anthropic diretamente dentro da plataforma de IA da Microsoft.

O modelo foi construído para trabalhos que vão muito além de um único prompt: construir funcionalidades em uma base de código inteira, rastrear problemas de produção, sintetizar documentos e planilhas longas, e produzir memorandos, relatórios ou apresentações que exigem menos edição do que as saídas do Opus 5. Ele identifica causas-raiz antes de fazer alterações, verifica o próprio trabalho e explica as mudanças em linguagem simples.

Uma adição notável é a comunicação agêntica aprimorada. Enquanto um agente percorre dezenas de etapas, o Claude Opus 5.5 expõe o que fez, o que encontrou, quais decisões tomou e onde precisa de input do usuário, junto com um resumo ao final de uma tarefa longa — pensado para reduzir a necessidade de inspecionar cada etapa manualmente.

O modelo também introduz o raciocínio adaptativo, permitindo que desenvolvedores especifiquem um nível de "esforço" em vez de definir manualmente um orçamento de tokens de raciocínio, de forma que o modelo ajuste seu raciocínio à tarefa automaticamente. Junto com o modelo, a Anthropic está lançando capacidades de API em beta — compactação assíncrona, compactação keep-tail, e a possibilidade de trocar ferramentas no meio de uma conversa preservando o raciocínio e o cache de prompt — voltadas a agentes que rodam por períodos prolongados sem precisar reconstruir o estado da aplicação.

O preço do Claude Opus 5.5 (Global Standard, US DataZone) é de US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, com acertos de cache a US$ 0,20 por milhão de tokens, escritas de cache a US$ 5 por milhão, e escritas de cache de uma hora a US$ 8 por milhão. O mesmo preço se aplica a uma variante de Contexto Longo. Ambas estão disponíveis de forma geral agora, hospedadas no Azure.

A Anthropic também está ampliando as salvaguardas do modelo: o Claude Opus 5.5 é o primeiro modelo Opus a usar classificadores de segurança em áreas como cibersegurança, biologia, desenvolvimento de IA e destilação, introduzidos pela primeira vez com o Claude Fable 5.1. Pedidos comuns de desenvolvedores, educacionais e de trabalho de conhecimento permanecem inalterados, mas certos pedidos de maior risco ou de uso duplo podem ser encaminhados a um modelo Claude diferente, com salvaguardas adicionais.

Fonte: Azure Blog

Próximo passo

Visibility Analyzer

É isto que o Visibility Analyzer mede num site real: quais respostas citam você, quais páginas o motor não consegue recuperar e o que corrigir primeiro. Rodar é grátis.

Rodar uma auditoria de visibilidade grátis

Rodar é grátis. Sem cartão.

Preço
Grátis
Duração
Uma rodada, minutos

Plano grátis: duas análises por dia, sem cartão.