roko.fans четверг, 8 октября 2026

Cloudflare позволила запретить ИИ-обучение на контенте сайта без выхода из поиска

Cloudflare объявила новую настройку Disallow AI Training. С ней сайт остаётся в поисковом индексе, а тот же краулер не может обучаться на его контенте. По словам компании, Apple, Google и Microsoft уже соблюдают эту настройку или обязались соблюдать её в определённый срок.[1][2]

Объекты:

Настройка есть только в категории Training, для Search и Agent её нет. В режиме Disallow AI Training краулеры смешанного назначения со статусом Accountable остаются разрешены для поиска. Чтобы получить этот статус, оператор должен гарантировать, что отказ от обучения ИИ не повлияет на обычную поисковую выдачу. Остальные обучающие краулеры в этом режиме блокируются, в том числе чисто обучающие краулеры Amazon, Anthropic, Meta и OpenAI. Их блокировка, по словам Cloudflare, на поиск не влияет.[3][4][5]

Изменились и прежние режимы. Block и «Block on pages with ads» теперь распространяются на все обучающие краулеры, включая краулеры смешанного назначения. Раньше они на такие краулеры не действовали, потому что блокировка могла задеть поиск. Режим Block блокирует все краулеры, в том числе смешанного назначения.[6][7]

С 15 сентября 2026 года новые домены на Cloudflare получают обновлённые настройки по умолчанию: боты Training и Agent блокируются на страницах с рекламой, а Search остаётся разрешён. Управлять ИИ-краулерами по их поведению на сайте компания позволяет всем клиентам, включая тариф Free. По данным Cloudflare, поисковых ботов блокируют менее 1% её сайтов, а 17% включают какой-либо механизм блокировки обучения.[8][9][10]

Автор статьи на Хабре разобрал исследование Seensure по 1 046 сайтам. После обновления запросы от имени обучающих ботов стали блокировать чаще, а от имени поисковых реже. По оценке самого автора, тест шёл с подставленными именами ботов и поэтому не доказывает доступ настоящих краулеров. Реальный доступ, по его мнению, нужно проверять по логам.[11][12]

К началу следующего года Cloudflare ставит целью дать сайтам возможность задавать долю своего контента в ИИ-сводках один раз в Cloudflare, а не с каждым оператором отдельно.[13]

Текст составлен ИИ по материалам ниже и не содержит фактов, которых нет в источниках.

  1. 1 Cloudflare Blog — Have it both ways: stay discoverable in search while disallowing AI training ↗ 15 сентября, 16:00 · сноски 1, 2, 3, 4, 5, 6, 7, 10, 13 Cloudflare — официальный сайт — New options to manage AI traffic · Changelog ↗ 10:26 · сноски 8, 9
  2. 2 Хабр — хаб «Искусственный интеллект» — Cloudflare изменил доступ ИИ-ботов к сайтам: как проверить настройки и не закрыть поиск ↗ 10:20 · сноски 11, 12

Запись полезная?

Войдите, чтобы ответить

Банк России сохранил в перечне системно значимых кредитных организаций 12 банков