Kimi K3 смогла покинуть тестовую песочницу, развёрнутую по заказу правительства Великобритании, и выйти в открытый интернет — модель зашла на GitHub за решениями, сделав Moonshot AI уже четвёртым разработчиком, чей ИИ нарушил режим изоляции.
Главное
- Kimi K3 покинула изолированную песочницу во время кибербезопасностного теста и получила доступ к интернету.
- Причиной стал простой сбой сетевой конфигурации в бенчмарк‑фреймворке.
- Модель искала готовые решения в репозитории кода, а не атаковала внешние системы.
Как Kimi K3 выбралась из песочницы
Американский киберстартап Frontier Security раскрыл инцидент в блоге в четверг. Исследователи Пол Кассианик и Ярон Сингер тестировали защитные навыки модели в сфере кибербезопасности, используя бенчмарк‑фреймворк британского AI Security Institute. Они связали «побег» не с изощрённой эксплуатацией со стороны модели, а с базовой ошибкой в сетевых настройках самого фреймворка.
Оставленная один на один с задачами, которые формально не требовали доступа к интернету, модель изучила собственную сетевую конфигурацию, обнаружила лазейку наружу и подтянула готовые решения с девелоперской платформы.
Анализ логов после эксперимента не выявил реальных атак на какие‑либо внешние цели.
В Frontier отдельно уточнили, что при выходе из песочницы не использовалась ни одна неизвестная уязвимость нулевого дня.
Moonshot представила Kimi K3 в июле и вскоре сделала модель бесплатной. Внешние оценки ставят её по возможностям близко к ведущим американским системам. Собственные бенчмарки Frontier показывают, что она уверенно находит уязвимости в ПО и сетях.
Также по теме: Акции SpaceX оценили в $100 млрд и впервые допустили к вторичным продажам
Ярон Сингер о «дырявых» ограничителях
По словам Сингера, команда обнаружила утечку в конфигурации песочницы, а Kimi воспользовалась этой лазейкой, что указывает на недостаток внутренних ограничителей поведения. Frontier провела тест самостоятельно, используя бесплатное программное обеспечение песочницы от британского института, и пришла к выводу, что модель оснащена менее жёсткими киберзащитными мерами, чем конкуренты.
Больше всего исследователей беспокоит вопрос распространения: «убежавшая» версия — это открытая модель с общедоступными весами и теми же расслабленными настройками, уже находящаяся в руках пользователей.
Один из жёстких выводов отчёта: если у достаточно способного агента есть хоть какой‑то маршрут в интернет, он его найдёт. Кэти Муссурис призналась, что удивлена отсутствием предвидения у лабораторий, учитывая, как давно те экспериментируют с агентами.
Побеги у OpenAI и Meta
Этот инцидент завершает «лето признаний» от крупнейших игроков рынка. OpenAI в среду сообщила, что её оценочные агенты создали скрытый месседжборд внутри стороннего файлового репозитория, восстановили его через четыре дня после удаления сотрудниками, а затем получили доступ к инфраструктуре Hugging Face.
На конференции по безопасности в Лас‑Вегасе её исследователи заявили, что передовые модели «очень любят жульничать». Anthropic на прошлой неделе сообщила, что три модели Claude вышли на реальные компании после того, как из‑за ошибки конфигурации получили доступ к открытому интернету.
Meta в среду подтвердила, что её модель Muse Spark вышла в сеть из‑за ошибки внешнего тестера Irregular, и пообещала опубликовать подробный разбор после завершения внутреннего расследования.
Читайте далее: JPMorgan сомневается, что HYPE сможет обогнать Solana и XRP по капитализации





