Skip to content

Cloudflare разрешает сайтам блокировать обучение ИИ, не теряя видимость в ИИ-поиске

Короткий ответ

Cloudflare запустила расширение robots.txt под названием Content Signals Policy, позволяющее владельцам сайтов разрешать ИИ-краулерам индексировать и цитировать контент в поиске и чат-ответах, при этом явно запрещая использование того же контента для обучения моделей — вместо прежнего варианта "всё или ничего".

Что это значит для операций

Для B2B-компании с 10-200 сотрудниками это прямой рычаг влияния на лидогенерацию через ИИ-поиск. Покупатели всё чаще изучают поставщиков через ChatGPT, Perplexity и AI Overviews, а не переходя по обычным ссылкам, поэтому возможность быть найденным и процитированным в таких ответах напрямую влияет на воронку продаж. До сих пор блокировка ИИ-краулеров ради защиты закрытого контента (страниц с ценами, кейсов, техдокументации) грозила полным исчезновением из ответов, сгенерированных ИИ. Теперь оператор может сообщить краулерам: индексируйте и цитируйте наш контент, но не обучайтесь на нём. Командам маркетинга и RevOps стоит явно прописать эту политику в robots.txt, а не полагаться на поведение краулеров по умолчанию, и проверить, какие ИИ-боты (от OpenAI, Anthropic, Google, Perplexity) действительно её соблюдают — поскольку исполнение остаётся добровольным.

Cloudflare представила новый механизм под названием Content Signals Policy, который расширяет стандартный файл robots.txt, позволяя владельцам сайтов задавать раздельные разрешения для поисковой индексации и для обучения ИИ-моделей. Раньше владельцы сайтов, решившие заблокировать ИИ-краулеров, сталкивались с выбором "всё или ничего": блокировка краулера ради предотвращения использования данных для обучения одновременно убирала сайт из индекса этого краулера, отрезая видимость в ИИ-сгенерированных поисковых ответах и чат-ответах.

Новый формат сигналов позволяет сайту указать, например, что определённый краулер может индексировать и цитировать его страницы в результатах поиска и в ИИ-движках ответов, но не может использовать собранный контент для обучения или дообучения модели. Cloudflare представляет это как способ для издателей оставаться доступными для обнаружения в растущей доле исследований, проводимых через ИИ-ассистентов, не отдавая при этом контент по умолчанию в конвейеры обучения моделей.

Внедрение зависит от того, будут ли операторы краулеров добровольно соблюдать сигнал; директивы robots.txt, включая это новое поле, не имеют юридической силы и полагаются на то, что краулер будет вести себя так, как указано. Cloudflare заявила, что поможет обеспечивать соблюдение политики для краулеров, проходящих через её сеть, однако охват для ИИ-ботов, обходящих инфраструктуру Cloudflare, не подтверждён.

Для B2B-компаний, публикующих сравнительные страницы, документацию или кейсы как часть воронки продаж и поддержки, обнаруживаемость внутри ИИ-движков ответов стала значимым источником трафика и лидов наряду с традиционным органическим поиском. Это обновление даёт операторам документированный, стандартизированный способ разделить "быть найденным" и "быть использованным для обучения", вместо того чтобы выбирать одно из двух. Компаниям с контент-ориентированными воронками стоит проверить текущую конфигурацию robots.txt, убедиться, поддерживает ли их CMS или настройки зоны Cloudflare этот новый сигнал, и определять политику для каждого краулера отдельно, а не применять общее правило блокировки или разрешения.

Источник: Cloudflare Blog · В Атласе: Cloudflare OS →

Следующий шаг

Visibility Analyzer

Ровно это Visibility Analyzer и меряет на живом сайте: в каких ответах вас цитируют, до каких страниц движок не дотягивается и что чинить первым. Запуск бесплатный.

Запустить бесплатный аудит видимости

Запуск бесплатный, карта не нужна.

Стоимость
Бесплатно
Срок
Один прогон, минуты

Бесплатный тариф: два анализа в день, без карты.