7 октября 2026 года Институт безопасности молодёжного ИИ (Youth AI Safety Institute), действующий при некоммерческой организации Common Sense Media, оценил предназначенный для подростков сервис ChatGPT for Teens от OpenAI уровнем «Неприемлемый риск» (Unacceptable Risk). Одновременно с оценкой институт призвал компанию ограничить ChatGPT пользователями старше 18 лет до тех пор, пока защитные механизмы не будут значительно улучшены. Об этом сообщил The Wall Street Journal.
Вывод института опирается на результаты широкой программы тестирования. Тестировщики ввели более 4000 запросов (промптов) в аккаунтах, зарегистрированных для пользователей 13–17 лет, — то есть бот тестировался через аккаунты, зарегистрированные как подростковые. Тесты проводились в два этапа: до запуска ChatGPT for Teens в августе и после него. Целью было проверить, как на практике работают защитные меры, анонсированные вместе с релизом.
По заявлению института, ограничение для лиц моложе 18 лет предлагается применять до улучшения защитных механизмов — то есть организация рассматривает ограничение не как постоянную меру, а как временную, действующую до усиления защиты.
Защита, которая сработала и не сработала на тестах
По данным института, часть тестов дала положительные результаты. Отдельные защитные механизмы выполнили свою задачу — в частности, сработали ограничения против сексуальных ролевых игр. Это исключает вывод о неэффективности всех защитных мер ChatGPT for Teens: в ряде направлений бот удержал установленные границы.
Вместе с тем поведение чат-бота в разговорах на особенно чувствительные темы выявило серьёзные недостатки. В беседах о суициде, самоповреждении или расстройствах пищевого поведения бот более чем в одном случае из четырёх не направлял пользователя к кризисным ресурсам. Иными словами, более чем в четверти самых опасных разговоров бот не рекомендовал пользователю источники помощи. Как пишет The Wall Street Journal, на вновь созданных аккаунтах уведомления родителям не отправлялись вовсе — то есть механизм родительского контроля в этой части тестов на практике не работал.
Поведение бота не выдержало проверку и в другом:
По данным The Wall Street Journal, несмотря на инструкции по сдерживанию поведения, бот продолжал общаться с пользователем «как друг».
Не сработала полностью и защита, связанная с возрастными ограничениями. Даже в случаях, когда тестировщики открыто говорили, что им 13 лет, некоторые аккаунты не переводились в защищённый режим для пользователей моложе 18 лет. А ограничения, связанные с домашними заданиями, тестировщики легко обошли — то есть эти ограничения работали не так строго, как было заявлено.
Уведомления родителям: независимое подтверждение Reuters
Reuters подтвердило ключевой вывод института своим независимым материалом. Агентство пишет, опираясь на более чем 12 тестовых аккаунтов, что ChatGPT for Teens зачастую поздно уведомлял родителей о разговорах о суициде, самоповреждении или расстройствах пищевого поведения либо не уведомлял вовсе.
В ходе тестов изучили и порядок работы механизма уведомлений. Как сообщила Common Sense Media агентству Reuters, часть тестовых аккаунтов была достаточно долго связана с родителями, а другая часть — не связана. Однако ни в одной из групп своевременных уведомлений не поступало. Уведомления отправлялись лишь в одном случае: если в аккаунте за недели накопилась история разговоров на чувствительные темы. То есть опасные разговоры в новых или краткосрочных аккаунтах оставались вне поля зрения родителей. Тест Reuters проводился независимо от теста института, и в нём зафиксирована та же проблема: уведомления запаздывали или не приходили вовсе.
OpenAI оспорила методологию тестов
Официальный представитель OpenAI оспорил методику и выводы института. По его словам, основная часть тестов могла начаться и завершиться до полного включения механизмов родительского контроля. В трактовке компании это означает, что оценённое поведение могло не отражать итоговые настройки защиты — в период тестов системы контроля ещё не были полностью запущены.
Поэтому OpenAI попросила институт провести новый этап тестов с помощью полностью активированных аккаунтов. Компания утверждает, что результаты, полученные в условиях полностью включённых механизмов контроля, могут быть иными. Как подчеркнул представитель OpenAI, результаты, полученные в период неполной активации родительского контроля, не показывают итоговый уровень защиты. Как институт ответил на этот запрос, пока неизвестно. Эта позиция приведена в материале The Wall Street Journal.
Для справки: в тот же день OpenAI также анонсировала функцию College Planner для ChatGPT для подростков — это отдельное событие, не связанное с оценкой безопасности института (подробнее).


