Какой шаг сделала OpenAI
OpenAI в блоге от 5 октября 2026 года объявила, что начнёт ставить невидимые метки (watermark) на тексты, создаваемые ChatGPT и Codex. Решение принято для соответствия требованиям закона Европейского союза об искусственном интеллекте (AI Act). По сообщению компании, маркировка в ближайшие недели будет внедрена для пользователей ChatGPT и Codex всех тарифов в Евросоюзе.
Разработчики по всему миру уже сейчас могут включить маркировку для отдельных моделей, но за пределами Евросоюза она по умолчанию останется отключённой. То есть автоматическая маркировка пока касается только территории ЕС. Ars Technica независимо подтвердила сообщение, отметив, что маркировка по умолчанию включается только в ЕС, и это соответствует заявлению компании. Маркировка охватывает соответствующих пользователей ChatGPT и Codex на всех тарифных планах: ограничение применяется по территориальному, а не тарифному принципу. Внедрение будет не мгновенным, а поэтапным — в течение ближайших недель. Это один из крупных шагов лабораторий ИИ к тому, чтобы текст, созданный ИИ, стал обнаруживаемым в массовом масштабе.
Как работает маркировка
Метод называется textGrain. OpenAI опубликовала по нему технический отчёт; отчёт написан совместно с исследователями Пенсильванского университета и Йельского университета и открыто описывает принципы работы метода. textGrain упорядочивает предсказания модели о следующем слове с помощью секретного ключа: при генерации текста выбор слов тонко подстраивается под заранее заданный шаблон.
В результате читатель не замечает разницы в тексте, но специальный детектор способен распознать шаблон. Метка переносится вместе с скопированным текстом: при переносе фрагмента в другое место метка сохраняется. Важно, что метка не идентифицирует пользователя — она лишь показывает, что текст создан ИИ. По данным OpenAI, маркировка не оказала заметного влияния на качество модели. В техническом отчёте говорится, что секретный ключ упорядочивает предсказания модели о следующем слове в определённом порядке, и этот порядок образует читаемый для детектора шаблон: для читателя текст остаётся естественным, но в его статистической структуре скрыта метка.
"OpenAI will start adding an invisible watermark to text generated by ChatGPT and Codex in the European Union to comply with the EU AI Act, the company said Monday in a blog post." — сообщение TechCrunch
Границы обнаружения
Маркировка не является идеальной защитой. В своих тестах OpenAI отметила, что замена 10% слов синонимами снизила точность детектора примерно с 92% до 66%. Короткие фрагменты, математические ответы и переведённый текст тоже распознаются сложнее.
Поэтому детектор сначала не будет открыт широкой публике: доступ к нему получат только проверенные исследователи и экспертные организации. Компания открыто объявила об ограничениях и представляет технологию как практический инструмент на пути обнаружения текстов ИИ. Реальная эффективность маркировки будет оцениваться именно в рамках этих ограничений.
Кому доступен детектор
Доступ к детектору на первом этапе ограничен: его получат только проверенные исследователи и экспертные организации. Компания объясняет такой подход необходимостью независимой оценки технологии. Показатели точности — в том числе снижение с 92% до 66% при замене синонимами — будут проверяться в ходе этой оценки.
Таким образом, система маркировки состоит из двух частей: нанесение метки автоматическое и массовое (в Евросоюзе), а чтение метки пока остаётся в распоряжении узкого круга специалистов. OpenAI пока не сообщила, когда откроет детектор широкой публике.
Правовая основа и график внедрения
OpenAI напрямую связала шаг с законом Евросоюза об ИИ. Закон требует, чтобы контент, исходящий от систем ИИ, был обнаруживаемым, — поэтому компания включает маркировку по умолчанию именно для пользователей в ЕС. За пределами Евросоюза маркировка остаётся добровольной: разработчики уже могут включить её для отдельных моделей, но по умолчанию она остаётся отключённой. Таким образом, внутри ЕС метка ставится автоматически, в остальных регионах решение остаётся за разработчиком.
Хронология такова: 5 октября OpenAI объявила план в блоге, на следующий день Ars Technica независимо подтвердила сообщение. Практическое внедрение будет поэтапным и завершится в ближайшие недели. Независимое подтверждение Ars Technica также зафиксировало именно этот аспект — включение маркировки по умолчанию только в ЕС — вместе с пояснением компании о соответствии закону. Это решение — наглядный пример того, как крупные лаборатории ИИ внедряют механизмы обнаружения контента под давлением законодательных требований.




