Игорь Градов
Игорь Градов
5 мин
ai

Meta заблокировала 33,2 млн единиц контента: как работает ИИ-защита от абьюза детей

Meta за полгода заблокировала 33,2 млн единиц контента с насилием над детьми и впервые применила LLM для поиска скрытой рекламы, ведущей на нелегальные сайты.

Meta заблокировала 33,2 млн единиц контента: как работает ИИ-защита от абьюза детей
Почему это важно

Впервые крупная платформа проверяет не только содержимое объявления, но и то, куда оно ведёт пользователя, а для поиска скрытых схем использует большую языковую модель.

В первой половине 2026 года Meta отчиталась о масштабных мерах против распространения материалов сексуальной эксплуатации детей (CSEM, Child Sexual Exploitation Material) на Facebook и Instagram. Компания представила набор инструментов на базе ИИ, направленных против рекламных объявлений, которые выглядят безобидно, но перенаправляют пользователей на нелегальный контент за пределами платформ Meta. Ниже разбираем, как устроена эта ИИ-защита от абьюза и что из неё можно взять на вооружение.

Что понадобится для понимания

  • Базовое представление о том, как работает рекламный кабинет Facebook и Instagram (достаточно уровня «запускал хотя бы одну рекламу»).
  • Понимание термина LLM (Large Language Model, большая языковая модель, та же технология, что стоит за ChatGPT и YandexGPT): модель, обученная на больших объёмах текста и способная анализировать смысл написанного.
  • 10 минут на чтение и осмысление.

Как Meta ищет скрытые объявления: пошагово

  1. Сканирование содержимого объявления. Классические системы модерации проверяют текст, изображения и видео внутри рекламы. По данным Meta, более 97% контента с эксплуатацией детей обнаруживается автоматически, до жалоб пользователей. В Индии этот показатель превышает 98%.

  2. Анализ «сигнальных указателей» (signposting). Meta внедрила новую LLM-систему, которая выявляет так называемый signposting. Это приём, когда объявление само по себе не содержит запрещённого материала, но скрыто направляет пользователя на внешний сайт с нелегальным контентом. По сути, реклама работает как «дорожный указатель» к преступному ресурсу. Именно эта техника, по словам Meta, всё чаще используется злоумышленниками, которые адаптируют свои методы, чтобы обходить модерацию.

  3. Проверка точки назначения. Теперь Meta анализирует не только то, что написано в объявлении, но и куда оно ведёт. Если целевой сайт нарушает правила платформы, его блокируют, а аккаунт рекламодателя удаляют.

  4. Дополнительные ИИ-сканы. Компания запустила вторичные проверки на базе ИИ, которые ищут контент, пропущенный первичными системами. Meta заявила, что будет добавлять новые сигналы по мере изучения работы преступных сетей.

  5. «Красная команда» на базе ИИ-агента (red-teaming AI agent). Отдельный ИИ-агент (автономная программа, которая действует по заданной цели без пошаговых команд человека) тестирует собственные защитные системы Meta. Он ищет уязвимости, которые могли бы использовать злоумышленники, и помогает закрыть дыры до того, как ими воспользуются.

  6. Отслеживание повторных аккаунтов. Meta улучшила системы, которые распознают пользователей, возвращающихся на платформу под новыми учётными записями после удаления предыдущих.

Контекст: давление и урегулирование

Новые меры появились на фоне продолжающегося давления на Meta со стороны законодателей и судов. В августе 2025 года компания согласилась выплатить до 18 млрд долларов для урегулирования иска о детской безопасности, поданного 29 штатами США (сумма по данным самой Meta).

В течение 2026 года Meta также ввела родительский контроль для Meta AI, специальные «подростковые» аккаунты в WhatsApp и оповещения для родителей, когда дети ищут в Instagram контент, связанный с самоповреждением. В сентябре WhatsApp добавил дополнительные настройки: родители могут ограничивать использование каналов подростками, контролировать видимость статусов и управлять добавлением в группы.

Что это значит для вас?

  • Авторам Дзена и контент-маркетологам. Техника signposting, когда безобидный пост служит «указателем» на внешний ресурс, актуальна не только для преступников. Рекламные площадки учатся читать намерение, а не только букву объявления. Если вы продвигаете контент через рекламу, убедитесь, что посадочная страница соответствует тому, что обещает объявление. Алгоритмы всё чаще проверяют конечную точку, а не только текст.

  • Маркетологам и предпринимателям. ИИ-защита от абьюза в рекламных системах ужесточается по всему миру. Ожидайте, что Яндекс Директ и VK Реклама будут внедрять похожие механизмы: проверку не только креатива, но и сайта, на который ведёт реклама. Готовьте посадочные страницы к более глубокой автоматической проверке.

  • Всем, кто работает с детской аудиторией. Если ваш продукт или контент рассчитан на подростков, следите за новыми ограничениями платформ. Meta движется к модели, где родитель получает контроль по умолчанию, а не по запросу. Российские площадки пока отстают, но тренд очевиден.

Как работает signposting на практике

Злоумышленник размещает рекламу товара для детей: яркая картинка, обычный текст, ничего подозрительного. Но ссылка ведёт на сайт, где среди легального контента спрятаны страницы с незаконным материалом. Старая система видела только объявление и пропускала его. Новая LLM-система Meta анализирует текст объявления на скрытые «сигналы» (определённые формулировки, паттерны ссылок) и одновременно проверяет, куда реально попадает пользователь. Результат: блокировка сайта и удаление аккаунта рекламодателя.

Частые ошибки

Не путайте обычную модерацию с тем, что делает новая система. Классический фильтр ищет запрещённые изображения и слова в самом объявлении. LLM-система ищет намерение: она «понимает», что нейтральный текст может быть маскировкой. Это значит, что даже полностью «чистое» объявление может быть заблокировано, если алгоритм сочтёт, что оно ведёт на опасный ресурс. Для добросовестных рекламодателей риск ложного срабатывания пока неизвестен, Meta не раскрыла данных о точности новой системы.

Мнение редакции dzen.guru

По моим наблюдениям, подход Meta с проверкой «куда ведёт реклама» скоро станет стандартом для всех крупных платформ. Для тех, кто работает в рунете, это сигнал: держите посадочные страницы в порядке, не используйте редиректы и промежуточные домены без крайней необходимости. А техника signposting, к сожалению, уже встречается и в русскоязычном сегменте: безобидные посты с кликбейтом ведут на сомнительные Telegram-каналы. Чем раньше российские площадки внедрят аналогичную ИИ-защиту от абьюза, тем лучше. Честная оговорка: Meta не опубликовала ни процент ложных срабатываний, ни детали архитектуры LLM-системы, поэтому оценить реальную эффективность пока невозможно.

Рекламные платформы переходят от проверки «что написано» к проверке «что задумано», и это касается каждого, кто размещает объявления, не только злоумышленников. Держите посадочные страницы прозрачными и следите за обновлениями правил площадок: следующий раунд ужесточений, скорее всего, будет не только у Meta.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Google открыла бесплатный сервис для определения AI контента: миллион проверок в день
ai

Google открыла бесплатный сервис для определения AI контента: миллион проверок в день

Google открыла для всех сайт, который проверяет, создано ли изображение, видео или аудио нейросетью, и теперь любой пользователь может провести определение AI…

4 мин
Google создаёт ИИ платформу для игр
ai

Google создаёт ИИ платформу для игр

Почему это важно Google впервые выпустила платформу, где игру для браузера можно собрать текстовым промптом (текстовой командой на естественном языке) без…

5 мин
Healthleap привлёк $38 млн: искусственный интеллект в медицине приносит больницам 5x возврат
ai

Healthleap привлёк $38 млн: искусственный интеллект в медицине приносит больницам 5x возврат

Стартап Healthleap, который использует искусственный интеллект в медицине для поиска недиагностированных болезней по записям врачей, привлёк 38 миллионов…

4 мин