7 октября 2026 года Meta объявила о запуске новых инструментов искусственного интеллекта (ИИ), предназначенных для обнаружения рекламы, ведущей к материалам, связанным с сексуальной эксплуатацией детей. Об этом в один день сообщили и сама компания, и издание TechCrunch: TechCrunch подробно описал новые инструменты, а блог компании осветил меры по безопасности детей, принятые в Индии. По данным TechCrunch, новая LLM нацелена именно на скрытые перенаправления, стоящие за рекламой. Главное новшество охватывает два направления: большая языковая модель (LLM), отслеживающая, куда ведёт реклама, и отдельный ИИ-агент, который сам тестирует защитные системы. По данным компании, новые инструменты направлены на усиление контроля за рекламой в Facebook и Instagram. Оба объявления сделаны 7 октября 2026 года.
Проверяется и то, куда ведёт реклама
Запущенная компанией LLM специализируется на выявлении рекламы типа «signposting». «Signposting» — от английского «указатель», «направляющий знак»: такая реклама может выглядеть безобидно, но её задача — направлять пользователей к незаконным материалам о сексуальном насилии над детьми, размещённым за пределами платформы. Система создана именно для поиска таких скрытых перенаправлений — для их обнаружения Meta опирается на большую языковую модель, задача которой — выявлять признаки скрытого перенаправления.
Главное отличие нового подхода в том, что Meta теперь отслеживает не только то, что показывает сама реклама, но и то, куда она ведёт пользователя. Если реклама ведёт на внешний адрес, где выявлено нарушение, компания блокирует пути, ведущие на этот адрес, и принимает меры в отношении аккаунтов, стоящих за такой рекламой. То есть ответственность не ограничивается текстом рекламы — она доходит до уровня аккаунта. Меры применяются в два этапа: сначала блокируется реклама, ведущая на этот адрес, затем — принимаются меры в отношении аккаунта, разместившего рекламу.
Meta объяснила этот механизм так:
«Meta now scans where an ad leads, not just what it shows, so it can block violating off-platform destinations and take action against the accounts behind them.» — Meta (TechCrunch, 7 октября 2026 года)
Таким образом, контроль не ограничивается текстом и изображениями рекламы — проверка доходит до внешней страницы, которая открывается после клика по рекламе.
Отдельный ИИ-агент, тестирующий защитные системы
Meta также внедрила ИИ-агента для «red-teaming», который активно тестирует собственные средства защиты. Его задача — намеренно проверять защитные системы компании и находить уязвимости, которыми могут воспользоваться злоумышленники.
Работа агента направлена на выявление пробелов в линии защиты до того, как новые методы злоупотреблений получат широкое распространение. Его проверка нацелена не на внешнюю угрозу, а на сами защитные системы — то есть агент ищет уязвимости в самой защите. Иными словами, система не ждёт появления у нарушителей новых путей — она заранее ищет их вероятные пути и выявляет слабые места на ранней стадии.
Таким образом, компания действует одновременно в двух направлениях: с одной стороны, запущена LLM, находящая «signposting»-рекламу; с другой — внедрён агент, постоянно тестирующий сами защитные системы. Первый инструмент ловит существующую угрозу, второй — проверяет готовность защиты к будущим испытаниям.
Цифры за первое полугодие
По опубликованному Meta отчёту, за первое полугодие 2026 года в Facebook и Instagram были приняты меры в отношении 33,2 млн материалов, связанных с сексуальной эксплуатацией детей. Более 97% из них были выявлены собственными системами компании до того, как пользователи пожаловались, — это показывает, что основная нагрузка по выявлению лежит на автоматических системах.
Отдельно приведены показатели по Индии: с января по июнь 2026 года в стране были приняты меры в отношении 5,3 млн таких материалов, и более 98% из них были найдены и удалены до того, как кто-либо сообщил о них. Глобальные 33,2 млн и индийские 5,3 млн — оба показателя относятся к первым шести месяцам 2026 года, то есть к периоду январь–июнь, и в обоих случаях основная доля была выявлена автоматическими системами до жалоб пользователей.
Прямой порядок уведомлений в Индии
Meta сообщила, что теперь будет направлять случаи, связанные с безопасностью детей в Индии, напрямую в Национальный портал уведомлений о киберпреступлениях страны. Этот портал управляется Индийским центром координации киберпреступности (I4C). По заявлению компании, случаи будут передаваться в национальный портал напрямую в таком порядке.
Детали инструментов освещены в публикации TechCrunch; о мерах в Индии сообщил официальный блог Meta.
