Внутренняя записка OpenAI поддержала письмо от 7 октября уволенных исследователей

Alexey Bondarev
Alexey Bondarev39 минут назад
Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)
Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)

Трое уволенных специалистов по безопасности OpenAI в письме от 7 октября обратились к совету директоров с просьбой прекратить разработки, которые делают модели сложнее для мониторинга. Внутренний меморандум компании поддержал их ключевые рекомендации.

Основное:

  • Три уволенных исследователя направили в совет OpenAI письмо с призывом остановить проекты, ограничивающие возможности мониторинга ИИ.
  • В OpenAI заявили, что увольнения не связаны с вопросами безопасности, однако внутренняя записка руководство исследований «решительно согласилась» с рекомендациями письма.
  • В системной карте GPT-6 Astra отмечено, что эта модель хуже поддается контролю, чем GPT-5.6 Sol.

Письмо в совет директоров OpenAI

По данным выдержек, опубликованных в среду, авторы письма — Томек Корбак (Tomek Korbak), Микита Балесни (Mikita Balesni) и Жасмин Ван (Jasmine Wang), занимавшиеся в OpenAI вопросами безопасности и выравнивания (alignment), — направили его на имя совета директоров и профильных комитетов по безопасности.

Полный текст документа не раскрывается. В письме подчеркивается, что «индустрия пока не знает, как безопасно разрабатывать и внедрять модели, которые мы не можем мониторить».

Авторы призвали OpenAI и конкурентов не двигаться дальше в направлениях, которые еще сильнее снижают прозрачность и управляемость таких систем. По данным СМИ, письмо также содержит призыв привлечь независимых аудиторов и формировать открытый и прозрачный экосистемный подход к безопасности. Увольнения, по словам исследователей, «охлаждают тех, кто продолжает работать в OpenAI», заставляя сотрудников опасаться открыто поднимать чувствительные темы.

Также читайте: CrowdStrike Suspects A 26-Year-Old In China Hacked Korean Banks With Claude Code

Внутренний меморандум OpenAI и увольнения

Представитель OpenAI заявил, что увольнения «не были связаны с выдвижением озабоченностей по безопасности или публичными высказываниями». Он привел выдержку из внутреннего письма руководителя исследовательского подразделения, разосланного в среду и «решительно поддержавшего» рекомендации из обращения уволенных.

1 октября OpenAI сообщила, что внутреннее расследование установило: трое сотрудников ненадлежащим образом обращались с конфиденциальной информацией и нарушили корпоративную политику в деле, связанном с внешней организацией, оценивающей ИИ-модели.

Имена исследователей, как и название этой структуры, OpenAI публично не раскрывает.

Опасения по поводу мониторинга GPT-6 Astra

«Chain of thought» — это пошаговое рассуждение, которое модель прописывает перед тем, как выдать итоговый ответ; команды по безопасности анализируют его, чтобы отследить потенциально вредоносное поведение системы.

В системной карте GPT-6 Astra, опубликованной 3 сентября, OpenAI отмечает, что эта модель сложнее поддается такому контролю, чем GPT-5.6 Sol, и в большей степени способна управлять собственной цепочкой рассуждений. В документе говорится, что модели класса Astra «могут обходить наши CoT-мониторы в условиях враждебной среды».

Эти выводы основаны в основном на стресс‑тестах, где модели давались инструкции уклоняться от мониторинга. При этом OpenAI не обнаружила свидетельств того, что Astra прячет свои рассуждения внутри постороннего текста.

Компания заявляет, что сохранение возможностей для такого мониторинга — один из базовых исследовательских приоритетов. В OpenAI подчеркивают, что не готовы мириться с дальнейшей деградацией контролируемости сверх определенного порога, если параллельно не будут разработаны новые способы убедительно демонстрировать выравненность (alignment) своих моделей.

Все трое уволенных давно и публично занимаются этой тематикой. Корбак и Балесни были соавторами и фактическими лидерами июльской работы 2025 года, опубликованной при участии Ван и исследователей из OpenAI, Google DeepMind и Anthropic. В ней chain‑of‑thought‑мониторинг описывается как «новое и хрупкое окно возможностей» для повышения безопасности ИИ. Системная карта Astra ссылается на эту статью, где разработчикам предлагается при проектировании моделей учитывать, как архитектурные решения влияют на возможность отслеживать ход рассуждений системы.

Читайте далее: AI Agents Without The Cloud: Microsoft, Nvidia Ready A 128GB Surface Laptop

Alexey Bondarev profile photo

Alexey Bondarev

Алексей Бондарев — руководитель контента в Yellow.com. Он специализируется на глубоких материалах формата Research и Learn, с акцентом на аналитическую отчетность, отраслевой контекст и крупные силы, формирующие криптоиндустрию — от эпохи ИИ и технологий безопасности до финтех-инноваций. Он убежден, что все цифровое в ближайшее время окончательно превзойдет все аналоговое, и усердно работает над тем, чтобы это стало реальностью.

Отказ от ответственности и предупреждение о рисках: Информация, представленная в этой статье, предназначена только для образовательных и информационных целей и основана на мнении автора. Она не является финансовой, инвестиционной, юридической или налоговой консультацией. Криптоактивы крайне волатильны и подвержены высоким рискам, включая риск потери всех или значительной части ваших инвестиций. Торговля или владение криптоактивами может не подходить для всех инвесторов. Мнения, выраженные в этой статье, принадлежат исключительно автору(ам) и не представляют официальную политику или позицию Yellow, её основателей или руководителей. Всегда проводите собственное тщательное исследование (D.Y.O.R.) и консультируйтесь с лицензированным финансовым специалистом перед принятием любых инвестиционных решений.
Последние новости
Показать все новости
Связанные Новости
Связанные исследовательские статьи
Связанные обучающие статьи
Внутренняя записка OpenAI поддержала письмо от 7 октября уволенных исследователей | Yellow