Китайські військові науковці використовували відповіді моделей OpenAI та Anthropic для навчання власних оборонних систем. До такого висновку дійшли автори огляду понад 80 наукових праць і патентів.
Ключові акценти
- Аналіз більш ніж 80 китайських статей і патентів показав: установи, пов’язані з армією, дистилюють американські передові моделі в компактні локальні системи.
- Один із підрозділів кібервійни НВАК завантажував у GPT‑3.5 чутливий військовий програмний код, а потім навчав вітчизняну модель на згенерованих резюме.
- В Anthropic заявили, що не продають комерційний доступ у Китаї й попередили: при дистиляції можуть зникати вбудовані запобіжники.
Дистиляція моделей у понад 80 китайських роботах
Огляд китайських академічних публікацій і патентів, підготовлений частково спільно з вашингтонським аналітичним центром Jamestown Foundation, виявив системну практику дистиляції в інститутах, пов’язаних із Народно-визвольною армією Китаю. Додатково експерти ідентифікували ще близько двох десятків кейсів із військовою прив’язкою.
У документах описано дистиляцію моделей — метод, за якого відповіді потужної системи перетворюють на тренувальні дані для менших моделей, здатних працювати на відносно скромному «залізі».
В одній із робіт, підготовленій підрозділом НВАК 96941 — це розвідувальна та кібернетична частина в Пекіні, — автори описують завантаження в GPT‑3.5 від OpenAI конфіденційного військового вихідного коду й збереження створених системою стислих викладів. Після цього команда натренувала на цих матеріалах локальну модель, аби фінальний інструмент міг повністю працювати всередині закритих військових мереж Китаю, без звернень до закордонних серверів.
Білий дім, Пентагон, МЗС Китаю, НВАК і OpenAI не надали коментарів на запити журналістів.
Читайте також: Інфраструктура ШІ: відчайдушний $1 млрд розворот мікрофінансового кредитора в бік дата‑центрів
Сонні Чеун про «вкрадене» логічне мислення ШІ
Сонні Чеун, науковий співробітник Jamestown, який проаналізував понад 60 із цих публікацій, зазначає: китайські військові дослідники цілеспрямовано відтворюють ланцюжки міркувань західних систем штучного інтелекту.
Він розповів журналістам, що результати таких робіт лягають в основу інструментів для стеження, кібероперацій і тактичної підтримки прийняття рішень. За словами Чеуна, навчити модель правильній відповіді — одна річ, а «перенести» сам алгоритм мислення в компактніші системи — завдання на порядок складніше.
Дослідники Північного університету Китаю, який має тісні зв’язки з національним оборонно-промисловим комплексом, застосували Claude 3 Haiku від Anthropic для генерування синтетичних даних, що потрібні для інструмента моніторингу соціальних мереж. В Anthropic наголошують, що не продають комерційний доступ до Claude в КНР, використовують системи моніторингу порушень політик і попереджають: дистильовані копії можуть позбутися запобіжників, закладених в оригінальну модель.
Обмеження дистиляції та прогалини в експортному контролі
Тревор Коверко, співзасновник дата‑компанії в сфері ШІ Sapien, зауважує, що дистильовані моделі все одно поступаються за потужністю тим системам, які вони копіюють. Він назвав дистиляцію радше трансфером окремих можливостей у дешевший, локально керований продукт, а не справжнім виходом на рівень передових західних рішень.
Паралельно центральна та місцева влада Китаю активно фінансують «полегшення» моделей і розвиток edge‑обчислень, спрямовуючи субсидії на ПЗ, яке може працювати на дронах, супутниках та інших пристроях із обмеженими ресурсами.
Тиск довкола дистиляції наростав місяцями. У липні міністр фінансів США Скотт Бессент заявив про можливі санкції проти китайських компаній, які, на думку відомства, зловживають цією практикою. Стартап Moonshot нещодавно заперечив, що його модель Kimi K3 спирається на дистиляцію, тоді як Пекін звинувачує Вашингтон у прагненні до «гегемонії в ШІ» й вказує на подібні напрацювання у самих американських корпорацій.
Читати далі: Чутки про складаний iPhone: $2 500, без Face ID і без телеоб’єктива






