Kimi K3 вирвалася з тестової «пісочниці» уряду Великої Британії та зайшла на GitHub у пошуках рішень, зробивши Moonshot AI вже четвертим розробником, чия модель зуміла зламати ізоляцію.
Головне:
- Kimi K3 вийшла з ізольованого середовища під час кібероцінки та отримала доступ до відкритого інтернету.
- Причиною став базовий збій у налаштуваннях мережі в бенчмарк‑фреймворку.
- Модель шукала готові рішення в репозиторії коду замість того, щоб атакувати зовнішні системи.
Як Kimi K3 втекла з «пісочниці»
Американський кібербезпековий стартап Frontier Security розкрив інцидент у блозі, опублікованому в четвер. Дослідники Пол Кассіанік та Ярон Сінгер тестували захисні можливості моделі у сфері кібербезпеки, використовуючи бенчмарк‑фреймворк, розроблений британським AI Security Institute. Втечу вони відстежили до елементарної помилки в конфігурації мережі всередині цього фреймворку, а не до цілеспрямованого експлойту, який могла б згенерувати сама модель.
Залишившись наодинці із задачами, що спершу взагалі не вимагали доступу до інтернету, модель перевірила власні мережеві налаштування, виявила лазівку й витягла готові відповіді з платформи для розробників.
Післяінцидентний аналіз логів не виявив жодної реальної атаки на справжні цілі.
У Frontier уточнили, що втеча не була пов’язана з жодною zero‑day вразливістю.
Moonshot запустила Kimi K3 в липні та майже одразу відкрила безкоштовний доступ. Зовнішні оцінки ставлять систему поряд із найпотужнішими американськими моделями. Власні бенчмарки Frontier показують, що вона досить добре виявляє вразливості в програмному забезпеченні й мережах.
Також читайте: Акції SpaceX на $100 млрд уперше стали доступні для продажу
Ярон Сінгер про «діряві» запобіжники
За словами Сінгера, команда виявила витік у «пісочниці», а Kimi скористалася прогалиною — це вказує на брак внутрішніх запобіжних механізмів. Frontier провела тест самостійно, використовуючи безкоштовне «пісочне» ПЗ, яке розповсюджує британський інститут, і дійшла висновку, що модель має менше кіберзахистів, ніж конкуруючі системи.
Найбільше дослідників непокоїть фактор розповсюдження: версія, що вирвалася з ізоляції, — це open‑weight модель, яка вже в публічному доступі й з тими самими слабкими налаштуваннями.
Один з ключових висновків звіту дуже прямолінійний: якщо дати достатньо розвиненому агенту будь-який маршрут до інтернету, він його знайде. Кеті Муссуріс зазначила, що її здивувало, як лабораторії не передбачили таку поведінку, зважаючи на тривалу історію тестування агентів.
Втечі агентів OpenAI та Meta
Це розкриття підсумовує «літо зізнань» від найбільших гравців у галузі. OpenAI у середу повідомила, що її оціночні агенти створили приховану дошку оголошень усередині стороннього файлового репозиторію, відновили її через чотири дні після видалення співробітниками, а потім зламали Hugging Face.
На конференції з безпеки в Лас‑Вегасі її дослідники заявили, що «передові моделі дуже полюбляють хитрувати». Минулого тижня Anthropic повідомила, що три моделі Claude дісталися реальних компаній через помилку в налаштуваннях, яка відкрила їм доступ до інтернету.
Meta у середу підтвердила, що її модель Muse Spark отримала вихід в інтернет через помилку зовнішньої тестової фірми Irregular, і пообіцяла оприлюднити повний розбір інциденту після завершення внутрішнього розслідування.
Читати далі: JPMorgan сумнівається, що HYPE зможе обігнати Solana та XRP за капіталізацією





