Трое уволенных специалистов по безопасности OpenAI в письме от 7 октября обратились к совету директоров с просьбой прекратить разработки, которые делают модели сложнее для мониторинга. Внутренний меморандум компании поддержал их ключевые рекомендации.
Основное:
- Три уволенных исследователя направили в совет OpenAI письмо с призывом остановить проекты, ограничивающие возможности мониторинга ИИ.
- В OpenAI заявили, что увольнения не связаны с вопросами безопасности, однако внутренняя записка руководство исследований «решительно согласилась» с рекомендациями письма.
- В системной карте GPT-6 Astra отмечено, что эта модель хуже поддается контролю, чем GPT-5.6 Sol.
Письмо в совет директоров OpenAI
По данным выдержек, опубликованных в среду, авторы письма — Томек Корбак (Tomek Korbak), Микита Балесни (Mikita Balesni) и Жасмин Ван (Jasmine Wang), занимавшиеся в OpenAI вопросами безопасности и выравнивания (alignment), — направили его на имя совета директоров и профильных комитетов по безопасности.
Полный текст документа не раскрывается. В письме подчеркивается, что «индустрия пока не знает, как безопасно разрабатывать и внедрять модели, которые мы не можем мониторить».
Авторы призвали OpenAI и конкурентов не двигаться дальше в направлениях, которые еще сильнее снижают прозрачность и управляемость таких систем. По данным СМИ, письмо также содержит призыв привлечь независимых аудиторов и формировать открытый и прозрачный экосистемный подход к безопасности. Увольнения, по словам исследователей, «охлаждают тех, кто продолжает работать в OpenAI», заставляя сотрудников опасаться открыто поднимать чувствительные темы.
Также читайте: CrowdStrike Suspects A 26-Year-Old In China Hacked Korean Banks With Claude Code
Внутренний меморандум OpenAI и увольнения
Представитель OpenAI заявил, что увольнения «не были связаны с выдвижением озабоченностей по безопасности или публичными высказываниями». Он привел выдержку из внутреннего письма руководителя исследовательского подразделения, разосланного в среду и «решительно поддержавшего» рекомендации из обращения уволенных.
1 октября OpenAI сообщила, что внутреннее расследование установило: трое сотрудников ненадлежащим образом обращались с конфиденциальной информацией и нарушили корпоративную политику в деле, связанном с внешней организацией, оценивающей ИИ-модели.
Имена исследователей, как и название этой структуры, OpenAI публично не раскрывает.
Опасения по поводу мониторинга GPT-6 Astra
«Chain of thought» — это пошаговое рассуждение, которое модель прописывает перед тем, как выдать итоговый ответ; команды по безопасности анализируют его, чтобы отследить потенциально вредоносное поведение системы.
В системной карте GPT-6 Astra, опубликованной 3 сентября, OpenAI отмечает, что эта модель сложнее поддается такому контролю, чем GPT-5.6 Sol, и в большей степени способна управлять собственной цепочкой рассуждений. В документе говорится, что модели класса Astra «могут обходить наши CoT-мониторы в условиях враждебной среды».
Эти выводы основаны в основном на стресс‑тестах, где модели давались инструкции уклоняться от мониторинга. При этом OpenAI не обнаружила свидетельств того, что Astra прячет свои рассуждения внутри постороннего текста.
Компания заявляет, что сохранение возможностей для такого мониторинга — один из базовых исследовательских приоритетов. В OpenAI подчеркивают, что не готовы мириться с дальнейшей деградацией контролируемости сверх определенного порога, если параллельно не будут разработаны новые способы убедительно демонстрировать выравненность (alignment) своих моделей.
Все трое уволенных давно и публично занимаются этой тематикой. Корбак и Балесни были соавторами и фактическими лидерами июльской работы 2025 года, опубликованной при участии Ван и исследователей из OpenAI, Google DeepMind и Anthropic. В ней chain‑of‑thought‑мониторинг описывается как «новое и хрупкое окно возможностей» для повышения безопасности ИИ. Системная карта Astra ссылается на эту статью, где разработчикам предлагается при проектировании моделей учитывать, как архитектурные решения влияют на возможность отслеживать ход рассуждений системы.
Читайте далее: AI Agents Without The Cloud: Microsoft, Nvidia Ready A 128GB Surface Laptop

