1 час назад
Cloudflare позволит блочить обучающих ИИ-ботов?

Буду первым, кто не просто перепостит новость про обновление Cloudflare, а ещё и по сути прокомментирует, почему тема разделения ботов на поисковых и обучающих так важна для владельцев сайтов. Что показательно, тема ещё и совсем не новая: эти разговоры я слышал ещё года полтора назад — тогда все обсуждали формат llms.txt, который, к слову, так толком и не взлетел. Но ключевая идея была очевидна уже тогда: желающих закрыть свой веб-сайт от обучающих ботов в разы больше чем желающих закрыть сайт от поисковых ботов — 17 процентов против не более 1% (оценка самого Cloudflare, 2025).
В чём разница

Одно дело — тебя проиндексировал поисковый краулер и потом процитировал: в классической выдаче или в AI-обзоре, но со ссылкой на источник. Это дополнительный посещаемость, а посещаемость автору нужен как воздух: вся монетизация в конечном счёте живёт на самом сайте — реклама, подписки, свои продукты, нативка, реферальные ссылки. Способов множество, но каждому нужен свой трафик на своей площадке. Поэтому индексацию блокирует меньше 1% сайтов — резать поисковых ботов равно резать себе выручку.
Совсем другое дело — когда модель поглотила твой материал и выдаёт всю фактуру и выводы прямо в окне ответа. Может даже упомянуть тебя как автора, но без ссылки и без перехода — просто “есть такое мнение”. И всё, над чем ты пыжился-мурыжился — писал, агрегировал многолетний опыт, чтобы поделиться с аудиторией и потом это монетизировать, — схема раздаёт бесплатно. Отсюда и 17%: это те, кто весьма захотел и нашёл метод, хотя способы неочевидные и на поверхности не лежат. Дальше цифра будет только расти.
Кто практически блокировал разграничение

Ключевой момент: тормозили не вебмастера, а провайдеры ИИ-моделей. Им как раз нужно обучать модели на свежем человеческом контенте — без него модели деградируют, причём быстро. Это уже наблюдаемый эффект: интернет заваливает сгенерированным контентом, и модели всё чаще учатся на "трижды пересказанных" идеях.
Отсюда парадокс: одной рукой ИИ-компании хотят всё больше оригинального человеческого текста (иначе никак), иной рукой те же операторы обязаны предложить алгоритм, который устроит издателей: пустить поискового краулера и не пустить обучающего. Формат llms.txt должен был это закрыть, но не закрыл — часть провайдеров просто отказалась его поддерживать и соблюдать директивы.

Что технически изменил Cloudflare

За Cloudflare стоит больше 20% сайтов по всему миру. Заявлено, что организация договорилась с большинством крупных операторов через категорию Accountable: платформы обязуются соблюдать opt-out, обеспечивать прозрачность на уровне URL и гарантировать, что отказ от обучения не бьёт по позициям в поиске. В панели теперь три типа поведения роботов (поиск, обучение, агенты) и четыре режима блокировки, включая отдельный для страниц с рекламой. Google и Apple под критерии уже подходят, Microsoft обещает докрутить поддержку в начале 2027 года. Технически всё это ложится в robots.txt с директивой на запрет обучения при открытом доступе для поисковых роботов (разбор Cloudflare, 2025).
Cloudflare просто приняли подход удовлетворить потребность, которая на рынке с каждым днём всё заметнее, и будет всё сильнее с каждым периодом, так как нейровыдача меняет не только методы продвижения, но и сами паттерны поискового поведения интернет-пользователей — я разбирал это отдельно в материале про GEO как новую эпоху продвижения в нейросетях.
Почему я не жду, что заработает как надо

Разделить ботов механически на стороне сайта нельзя в принципе: один и тот же бот заходит сразу с двумя задачами — и формирует поиск, и обучает модель. Ни по user-agent, ни по IP их не растащить. Значит, вся конструкция держится на честном слове операторов и обещании соблюдать директивы. Верифицируемого способа проверить исполнение у вебмастера по-прежнему нет.

Но главная дыра даже не в этом. Контент утягивают не только модели, которые на нём учатся. Есть масса парсеров, которые просто забирают текст и бесплатно перепубликуют его у себя. Я как автор сталкиваюсь с этим постоянно: каждая публикация всплывает на трёх-пяти-десяти чужих сайтах. Будут ли те сайты закрываться от обучающих краулеров? Скорее всего нет. То есть схема не возьмёт мой материал с моего домена — но возьмёт его с чужого)

Куда это движется
Вектор одновременно верный. Недавно проходила новость, что Google начал деньгами мотивировать издателей за использование их контента в ответах нейросетей — пока в тестовом режиме, но это по сути тот же разговор — рынок пытается нащупать баланс: без живого человеческого текста модели деградируют, а человеку должно быть выгодно этот текст отдавать.
Моделям нужен тот, кому есть что сказать; на пересказе пересказов они "задыхаются". В сухом остатке ценность должна остаться у авторов, способных передавать смысл, опыт, фактуру.
Читают сейчас

2 часа назад
Deveillance представила Kalypta — программа, которое мешает нейросетям расшифровывать созвоны
Стартап-компания Deveillance показал Kalypta — программа, которое мешает нейросетям расшифровывать речь во время созвонов. Приложение работает локально и в реальном времени изменяет исходящий аудиопот

2 часа назад
Artec выпустила 3D‑сканер Neo с точностью до 0,025 мм и функция использвать меньше маркеров
Artec представила Neo — беспроводной 3D‑сканер для контроля качества и реверс‑инжиниринга. Одна из особенностей устройства заключается в гибридном режиме, в котором оператору не нужно покрывать всю де

3 часа назад
Samsung Gallery получит синхронизацию с Google Photos
Samsung готовит интеграцию фирменного приложения «Галерея» с Google Photos. Информацию об этом нашли в обновлении внутреннего сервиса Gallery Cloud Sync. Встраивание заменит собой уже существующую син

7 часов назад
DNS теперь маркетплейс — селлерам обещают комиссию в 25% и хранить товары на складах компании
На сайте DNS появился раздел для сторонних продавцов — «Селлерам». В контексте этого проекта сторонним поставщикам предлагается продавать товары через DNS. Пока инициатива работает в закрытом бета‑тес

7 часов назад
В OpenIDE появилась сопровождение C/C++ благодаря независимому разработчику
В маркетплейсе OpenIDE появился плагин C/C++ Support, для работы с C и C++. Его создал текст независимый разработчик из сообщества. Поддержку C++ пользователи просили давно, и автор решил не ждать, а