Перейти к содержимому

Azure Blog с точки зрения операций

Всё, что мы опубликовали по теме «Azure Blog», с точки зрения операционного отдела: что это меняет для B2B-компании на 10-200 человек.

  1. Главное

    В Microsoft Foundry появились две более дешёвые версии GPT-6 для рабочих агентов

    Microsoft сделала GPT-6 Sol и GPT-6 Luna общедоступными в Microsoft Foundry вместе с GPT-6 Astra, выстроив линейку из трёх моделей для рабочих агентов. Astra отвечает за сложные рассуждения, Sol - за общие производственные задачи, а Luna стоит в разы дешевле и рассчитана на массовые операции вроде извлечения данных, суммаризации и маршрутизации запросов.

    Что меняется для операций — Для компании, которая держит агентов поддержки или операционные боты на Azure, это прямой рычаг снижения расходов: вместо того чтобы прогонять каждую классификацию тикета или извлечение данных через дорогую модель с развитым рассуждением, теперь можно отдать рутинные массовые шаги GPT-6 Luna, оставив Sol или Astra для тех частей процесса, где действительно нужна экспертная оценка. По тарифу Global Standard для короткого контекста Luna стоит 0,10 доллара за миллион входных токенов и 0,50 доллара за выходные - против 2 и 10 долларов у Sol и 10 и 50 долларов у Astra, что меняет арифметику стоимости на задачу для тех, кто выполняет тысячи рутинных вызовов агента в день. Практический шаг - разложить существующий сценарий работы агента по этапам, отделить классификацию, маршрутизацию и суммаризацию от многошаговых рассуждений и распределить модели по этим этапам, а не использовать одну модель для всего подряд.

  1. Claude Opus 5.5 пришёл в Microsoft Foundry: дешевле токены и понятнее отчёты агентов

    Для B2B-компании на 10-200 человек, которая запускает агентов на Microsoft Foundry для составления отчётов, разбора тикетов поддержки или рефакторинга внутренних инструментов, практическое изменение двойное: более дешёвый кеш и токены снижают стоимость длинных агентных сессий в продакшене, а новая привычка модели показывать, что она сделала, что нашла и где нужен ответ пользователя, сокращает объём ручной проверки перед тем, как доверять результату агента. Адаптивное мышление также убирает шаг настройки - командам больше не нужно вручную подбирать бюджет рассуждений под каждую задачу, что важно для небольших операционных команд без выделенных AI-инженеров.

Следующий шаг

Бесплатная диагностика

Пятнадцать минут, почта не нужна. На выходе - карта того, куда уходит работа, и порядок, в котором её стоит автоматизировать.

Пройти бесплатную диагностику

Начинается сразу в браузере.

Стоимость
Бесплатно
Срок
15 минут

Список кандидатов по порядку остаётся у вас в любом случае.