Saltar al contenido

Microsoft Foundry suma dos niveles de GPT-6 más baratos para agentes en producción

Respuesta corta

Microsoft puso en disponibilidad general GPT-6 Sol y GPT-6 Luna en Microsoft Foundry, junto a GPT-6 Astra, formando una gama de tres niveles para agentes en producción. Astra maneja razonamiento complejo, Sol cubre cargas de trabajo generales y Luna está pensado para tareas masivas como extracción, resumen y enrutamiento de solicitudes a una fracción del costo de Astra.

Qué significa para las operaciones

Para una empresa que opera agentes de soporte u operaciones sobre Azure, esto es una palanca directa de costos: en lugar de enviar cada clasificación de tickets o extracción de datos a un modelo de razonamiento caro, los equipos pueden ahora usar GPT-6 Luna para pasos rutinarios y masivos, y reservar Sol o Astra para las partes del flujo que realmente requieren criterio. Con los precios Global Standard de contexto corto, Luna cuesta 0,10 dólares por millón de tokens de entrada y 0,50 de salida, frente a los 2/10 dólares de Sol y los 10/50 dólares de Astra, lo que cambia el cálculo de costo por tarea para quien realiza miles de llamadas rutinarias de agentes al día. El movimiento práctico es mapear un flujo de agente existente, identificar qué pasos son clasificación/enrutamiento/resumen frente a razonamiento de varios pasos, y asignar los modelos en consecuencia en lugar de usar uno solo para todo.

Microsoft ha ampliado su gama GPT-6 en Microsoft Foundry, poniendo en disponibilidad general GPT-6 Sol y GPT-6 Luna junto al modelo GPT-6 Astra ya existente.

Los tres modelos están pensados para funciones distintas dentro de un flujo de agentes. Astra se recomienda para razonamiento exigente, ingeniería de software y tareas de uso de computadora. Sol apunta a agentes de producción de propósito general, programación y trabajo de conocimiento en varios pasos. Luna está construido para tareas de alto volumen y menor complejidad: extracción, resumen, enrutamiento de solicitudes e interacciones rutinarias con clientes.

El precio escala con la capacidad. Con las tarifas Global Standard para contexto corto, Astra cuesta 10,00 dólares por millón de tokens de entrada y 50,00 dólares por millón de salida; Sol cuesta 2,00 dólares de entrada y 10,00 de salida; Luna cuesta 0,10 dólares de entrada y 0,50 de salida. Los despliegues en Data Zone de EE.UU. y la UE tienen un recargo del 10-20% sobre el precio Global. Microsoft está impulsando a los clientes a evaluar el "costo por tarea" en lugar del precio por token al elegir qué modelo maneja cada paso.

Las opciones de despliegue varían según el modelo. El despliegue estándar está disponible para los tres modelos en 28 regiones globales y en las Data Zone de EE.UU./UE. El Throughput Provisionado, que reserva capacidad, está disponible para Astra y Sol. El Procesamiento Prioritario, un carril de pago por uso más rápido, solo está disponible para Sol.

Microsoft menciona a Manus y Wolters Kluwer Tax & Accounting como clientes que ya ejecutan flujos de trabajo agénticos sobre modelos de Azure OpenAI, y el CTO de Wolters Kluwer señala que el razonamiento paso a paso de los modelos se ajusta a flujos de investigación y cumplimiento normativo que necesitan "resistir el escrutinio".

Las herramientas de evaluación y monitoreo de Foundry buscan ayudar a los equipos a decidir, con evidencia, qué nivel de modelo se ajusta a qué carga de trabajo, en lugar de recurrir por defecto a la opción más nueva o más capaz para cada tarea.

Fuente: Azure Blog

Siguiente paso

Visibility Analyzer

Esto es lo que el Visibility Analyzer mide en un sitio real: qué respuestas te citan, qué páginas el motor no puede recuperar y qué arreglar primero. Ejecutarlo es gratis.

Lanzar una auditoría de visibilidad gratuita

Lanzarlo es gratis. Sin tarjeta.

Precio
Gratis
Duración
Una ejecución, minutos

Plan gratuito: dos análisis al día, sin tarjeta.