Ir para o conteúdo

Microsoft Foundry ganha dois níveis mais baratos de GPT-6 para agentes em produção

Resposta curta

A Microsoft tornou o GPT-6 Sol e o GPT-6 Luna geralmente disponíveis no Microsoft Foundry, ao lado do GPT-6 Astra, formando uma linha de três níveis para agentes em produção. Astra cuida de raciocínio complexo, Sol atende cargas de produção gerais, e Luna é voltado a tarefas de alto volume como extração, resumo e roteamento de solicitações, a uma fração do custo do Astra.

O que isso significa na operação

Para uma empresa que roda agentes de suporte ou operações no Azure, isso é uma alavanca direta de custo: em vez de enviar cada etapa de classificação de tickets ou extração de dados por um modelo caro de raciocínio, as equipes agora podem colocar o GPT-6 Luna por trás de etapas rotineiras e de alto volume, reservando Sol ou Astra para as partes do fluxo que realmente exigem julgamento. Nos preços do Global Standard para contexto curto, o Luna custa US$ 0,10 por milhão de tokens de entrada e US$ 0,50 de saída, contra US$ 2/US$ 10 do Sol e US$ 10/US$ 50 do Astra — o que muda a conta de custo por tarefa para quem faz milhares de chamadas rotineiras de agente por dia. A ação prática é mapear um fluxo de agente já existente, identificar quais etapas são classificação/roteamento/resumo versus raciocínio de múltiplas etapas, e dividir a atribuição de modelos de acordo, em vez de usar um único modelo para tudo.

A Microsoft ampliou sua linha GPT-6 no Microsoft Foundry, tornando o GPT-6 Sol e o GPT-6 Luna geralmente disponíveis ao lado do já existente modelo GPT-6 Astra.

Os três modelos foram posicionados para funções diferentes dentro de um pipeline de agentes. O Astra é recomendado para tarefas exigentes de raciocínio, engenharia de software e uso de computador. O Sol é voltado a agentes de produção de propósito geral, codificação e trabalho de conhecimento em múltiplas etapas. Já o Luna foi construído para tarefas de alto volume e menor complexidade: extração, resumo, roteamento de solicitações e interações rotineiras com clientes.

O preço acompanha a capacidade. Nas tarifas do Global Standard para contexto curto, o Astra custa US$ 10,00 por milhão de tokens de entrada e US$ 50,00 por milhão de tokens de saída; o Sol custa US$ 2,00 de entrada e US$ 10,00 de saída; o Luna custa US$ 0,10 de entrada e US$ 0,50 de saída. Implantações em Data Zones nos EUA e na UE têm um adicional de 10% a 20% sobre o preço Global. A Microsoft está incentivando os clientes a avaliarem o "custo por tarefa", em vez do preço por token, na hora de decidir qual modelo cuida de qual etapa.

As opções de implantação variam por modelo. A implantação Standard está disponível para os três modelos em 28 regiões Global e nas Data Zones dos EUA/UE. O Provisioned Throughput, que reserva capacidade, está disponível para Astra e Sol. Já o Priority Processing, uma via pay-as-you-go mais rápida, está disponível apenas para o Sol.

A Microsoft cita Manus e Wolters Kluwer Tax & Accounting como clientes que já rodam fluxos agênticos sobre modelos Azure OpenAI, com o CTO da Wolters Kluwer observando que o raciocínio passo a passo dos modelos se encaixa em fluxos de pesquisa e conformidade que precisam "resistir a escrutínio".

As ferramentas de avaliação e monitoramento do Foundry têm o objetivo de ajudar as equipes a decidir, com evidências, qual nível de modelo se encaixa em qual carga de trabalho, em vez de recorrer por padrão à opção mais nova ou mais capaz para toda tarefa.

Fonte: Azure Blog

Próximo passo

Visibility Analyzer

É isto que o Visibility Analyzer mede num site real: quais respostas citam você, quais páginas o motor não consegue recuperar e o que corrigir primeiro. Rodar é grátis.

Rodar uma auditoria de visibilidade grátis

Rodar é grátis. Sem cartão.

Preço
Grátis
Duração
Uma rodada, minutos

Plano grátis: duas análises por dia, sem cartão.