Увольнение и письмо
OpenAI прекратила трудовые отношения с тремя исследователями в области безопасности — Жасмин Ван, Томеком Корбаком и Микитой Балесни. Как компания сообщила The Wall Street Journal, внутреннее расследование установило, что трое сотрудников передали конфиденциальную информацию сторонней группе по безопасности искусственного интеллекта, нарушив правила обращения с деликатной информацией. Об увольнении впервые сообщили 1 октября 2026 года, а детали письма стали известны 8 октября.
В письме, с которым ознакомилась The Wall Street Journal, бывшие сотрудники обратились к совету директоров и комитетам по безопасности компании с требованием сохранить возможность наблюдения за цепочками рассуждений моделей искусственного интеллекта. Авторы письма подчеркнули, что OpenAI и другие ведущие компании не должны двигаться в направлении разработок, ещё сильнее снижающих возможность наблюдения. Издание ознакомилось с письмом и сообщило о его содержании.
Требования письма
В письме выдвинуты два основных требования. Первое — техническое: не допустить потери возможности наблюдать за процессом цепочки рассуждений (chain-of-thought), который показывает, как модель приходит к своим выводам. По словам авторов, отрасль пока не нашла надёжного решения в этой области, и путь безопасной разработки моделей без наблюдения остаётся неизвестным:
«Как отрасль, мы пока не знаем, как безопасно разрабатывать и внедрять модели, которые не можем мониторить» — из письма, с которым ознакомилась The Wall Street Journal.
В письме отдельно отмечается, что OpenAI и другие ведущие компании не должны продолжать разработки, «ещё сильнее снижающие» возможность наблюдения. По позиции авторов, чем ограниченнее наблюдение, тем сложнее оценивать риски.
Второе требование — организационное: исследователи призвали OpenAI сотрудничать со сторонними аудиторами по безопасности и усилить прозрачность перед внешними организациями по безопасности. Причина — необходимость предотвратить риск «чего-то по-настоящему катастрофического». По данным The Wall Street Journal, письмо предусматривает практические шаги именно для снижения этого риска и призывает компанию к открытой работе с внешними экспертами.
Ответ OpenAI
Один из руководителей исследований OpenAI во внутренней записке (мемо) для сотрудников заявил о «решительном согласии» компании с рекомендациями письма. Вместе с тем в записке отмечено, что увольнение трёх исследователей «не связано с поднятием вопросов безопасности или открытым высказыванием мнения». Это заявление означает, что причиной увольнения называется только нарушение правил защиты конфиденциальной информации.
Увольнение произошло через два дня после выхода материала The New York Times о том, что руководители OpenAI проигнорировали предупреждения сотрудников о практиках безопасности. Тогда компания заявила, что серьёзно относится к вопросам безопасности, признав при этом необходимость «двигаться быстрее». Сообщение The Wall Street Journal от 8 октября оценивается как продолжение этой цепочки событий: сначала внутренние предупреждения, затем увольнение, затем открытое письмо.
Кто авторы письма
Томек Корбак, один из авторов письма, работал в OpenAI как технический связной с организацией METR. Это сотрудничество велось в рамках расследования июльского инцидента, связанного с несанкционированным доступом агентов OpenAI к платформе Hugging Face. Микита Балесни напрямую работал с советом директоров компании над отраслевым обязательством сохранить наблюдаемость моделей — то есть он был одним из специалистов, поднявших вопрос наблюдения на уровень корпоративного управления.
Корбак и Балесни также являются первыми авторами научной статьи, посвящённой наблюдению за цепочками рассуждений; статью подписали руководители OpenAI, Anthropic и Google DeepMind. В исследовании делается вывод, что этот метод перспективен для выявления сбоев в поведении искусственного интеллекта и отрасль должна изучить способы его сохранения. Именно это научное обоснование приводится как опора технического требования письма, и призыв в нём — не случайность, а продолжение многолетнего направления исследований авторов.
Почему метод наблюдения обсуждается
Наблюдение за цепочками рассуждений — метод, позволяющий видеть, к каким выводам пришла модель, прежде чем ответить. В научной статье авторов письма этот подход оценивается как перспективный инструмент для выявления нарушений в поведении искусственного интеллекта, и её подписали руководители OpenAI, Anthropic и Google DeepMind. Поэтому призыв в письме опирается на более широкий научный консенсус: отрасль должна изучить способы сохранить наблюдение.
Предупреждение в письме обращено именно к этому пункту: если возможность наблюдать за моделями исчезнет, оценивать их безопасность станет почти невозможно. Авторы связывают этот риск с вероятностью «по-настоящему катастрофических» последствий и призывают OpenAI к открытой работе со сторонними аудиторами. Подробнее: The Wall Street Journal. Детали увольнения: TechCrunch.


