Skip to content

Claude Opus 5.5 llega a Microsoft Foundry con tokens más baratos y reportes de agentes más claros

Respuesta corta

Claude Opus 5.5 de Anthropic ya está disponible de forma general en Microsoft Foundry, alojado en Azure, con un precio de $4/M tokens de entrada y $20/M de salida, además de lecturas de caché mucho más económicas. Suma pensamiento adaptativo y reportes paso a paso más claros para agentes de codificación y trabajo de conocimiento de larga duración, junto con herramientas beta de gestión de contexto para sesiones extendidas.

Qué significa para las operaciones

Para una empresa B2B de 10 a 200 personas que ejecuta agentes en Microsoft Foundry para redactar informes, triar tickets de soporte o refactorizar herramientas internas, el cambio práctico es doble: los costos más bajos de caché y de tokens abaratan las sesiones largas de agentes en producción, y el nuevo hábito del modelo de mostrar qué hizo, qué encontró y dónde necesita intervención humana reduce la revisión manual necesaria antes de confiar en la salida de un agente. El pensamiento adaptativo también elimina un paso de configuración: los equipos ya no necesitan ajustar manualmente el presupuesto de razonamiento por tarea, algo relevante para equipos de operaciones reducidos sin ingenieros de IA dedicados.

Claude Opus 5.5 de Anthropic ya está disponible de forma general en Microsoft Foundry, alojado en Azure, lo que da a desarrolladores y empresas acceso al modelo Opus más capaz de Anthropic directamente dentro de la plataforma de IA de Microsoft.

El modelo está diseñado para trabajos que van mucho más allá de un solo prompt: construir funciones a través de una base de código, rastrear problemas en producción, sintetizar documentos y hojas de cálculo extensos, y producir memos, informes o presentaciones que requieren menos edición que las salidas de Opus 5. Identifica causas raíz antes de hacer cambios, revisa su propio trabajo y explica los cambios en lenguaje simple.

Una adición notable es la comunicación agéntica mejorada. Mientras un agente avanza a través de docenas de pasos, Claude Opus 5.5 muestra qué hizo, qué encontró, qué decisiones tomó y dónde necesita intervención del usuario, junto con un resumen al final de una tarea de larga duración, con el objetivo de reducir la necesidad de inspeccionar cada paso manualmente.

El modelo también introduce el pensamiento adaptativo, que permite a los desarrolladores especificar un nivel de "esfuerzo" en lugar de fijar manualmente un presupuesto de tokens de pensamiento, de modo que el modelo escala su razonamiento a la tarea de forma automática. Junto con el modelo, Anthropic está lanzando capacidades beta de API —compactación asíncrona, compactación keep-tail y la posibilidad de cambiar herramientas en medio de una conversación preservando el pensamiento y el caching de prompts— pensadas para agentes que se ejecutan durante períodos prolongados sin necesidad de reconstruir el estado de la aplicación.

El precio de Claude Opus 5.5 (Global Standard, US DataZone) es de $4 por millón de tokens de entrada y $20 por millón de tokens de salida, con aciertos de caché a $0.20 por millón de tokens, escrituras de caché a $5 por millón y escrituras de caché de una hora a $8 por millón. El mismo precio aplica a una variante de Contexto Largo. Ambas están disponibles de forma general ahora, alojadas en Azure.

Anthropic también está ampliando las salvaguardas para el modelo: Claude Opus 5.5 es el primer modelo Opus en usar clasificadores de seguridad en áreas como ciberseguridad, biología, desarrollo de IA y destilación, introducidos por primera vez con Claude Fable 5.1. Las solicitudes comunes de desarrolladores, educación y trabajo de conocimiento no se ven afectadas, pero ciertas solicitudes de mayor riesgo o de doble uso pueden derivarse a otro modelo Claude con salvaguardas adicionales.

Fuente: Azure Blog

Siguiente paso

Visibility Analyzer

Esto es lo que el Visibility Analyzer mide en un sitio real: qué respuestas te citan, qué páginas el motor no puede recuperar y qué arreglar primero. Ejecutarlo es gratis.

Lanzar una auditoría de visibilidad gratuita

Lanzarlo es gratis. Sin tarjeta.

Precio
Gratis
Duración
Una ejecución, minutos

Plan gratuito: dos análisis al día, sin tarjeta.