Китайські військові науковці використали відповіді моделей OpenAI та Anthropic, щоб навчити вітчизняні оборонні системи штучного інтелекту. Про це свідчить огляд понад 80 наукових статей і патентів із Китаю.
Головне:
- Аналіз більш ніж 80 китайських робіт і патентів показав: установи, пов’язані з армією, “переганяють” передові американські моделі в компактні локальні системи.
- Один із кіберпідрозділів НВАК “нагодував” GPT-3.5 чутливим військовим кодом, а потім навчив вітчизняну модель на створених нею викладах.
- В Anthropic заявили, що не продають комерційного доступу в Китаї й попередили: скопійовані через дистиляцію системи втрачають вбудовані запобіжники.
Масштабна дистиляція моделей у понад 80 китайських дослідженнях
Огляд китайських академічних праць і патентів, підготовлений зокрема за участі вашингтонського аналітичного центру Jamestown Foundation, виявив системне використання американських “рубіжних” ШІ в інституціях, пов’язаних із Народно-визвольною армією Китаю. Додатково дослідники ідентифікували ще близько двох десятків кейсів із військовою прив’язкою.
Йдеться про так звану дистиляцію моделей – підхід, коли відповіді потужної системи перетворюють на тренувальний датасет для менших моделей, що здатні працювати на скромніших обчислювальних ресурсах.
В одній із робіт підрозділу 96941 НВАК – це розвідувальна й кібероперативна частина в Пекіні – дослідники описують, як вони передавали GPT-3.5 від OpenAI фрагменти секретного військового програмного коду й зберігали сформовані нею резюме. Потім на цьому масиві текстів навчили локальну модель, щоб готовий інструмент працював виключно всередині закритих військових мереж Китаю, без доступу до іноземних серверів.
Білий дім, Пентагон, МЗС КНР, НВАК і OpenAI відмовилися або не встигли надати коментар.
Також читайте: Інфраструктура ШІ: як мікрофінансова компанія намагається стати гігантом дата-центрів, ризикуючи $1 млрд
Коментар Сонні Чуна: коли “крадуть” не код, а логіку ШІ
Сонні Чун, науковий співробітник Jamestown Foundation, який проаналізував понад 60 із цих робіт, стверджує, що китайські військові системно “відтискають” логічні ланцюжки західних моделей.
Він зазначив журналістам, що такі розробки підживлюють системи спостереження, кібероперації та блоки тактичної підтримки рішень. За його словами, навчити модель правильної відповіді – одне, а перенести самі міркування, які ведуть до цієї відповіді, у меншу систему – значно складніше завдання.
Дослідники Північного університету Китаю, який пов’язують із оборонно-промисловим комплексом, застосували Claude 3 Haiku від Anthropic для генерації синтетичних даних, на яких навчали інструмент моніторингу соцмереж. В Anthropic наголосили, що не продають комерційний доступ до Claude у межах КНР, використовують власні системи моніторингу для виявлення порушень політик і попередили: дистильовані копії можуть позбутися ключових захисних механізмів оригіналу.
Межі дистиляції та прогалини експортного контролю
Тревор Коверко, співзасновник ШІ-датакомпанії Sapien, вважає, що дистильовані моделі все одно поступаються за потужністю тим системам, із яких їх “знімали”. Він назвав цю практику не шляхом до справжньої технологічної самостійності, а радше перенесенням вибіркових можливостей у дешевший, повністю контрольований локальний продукт.
Паралельно центральна й місцева влада Китаю активно фінансують “полегшення” моделей і розбудову edge-обчислень, спрямовуючи субсидії в софт, що працює на дронах, супутниках та інших пристроях із обмеженими ресурсами.
Тиск навколо таких підходів наростав упродовж останніх місяців. Міністр фінансів США Скотт Бессент у липні пригрозив санкціями китайським компаніям, які, на думку його відомства, займаються дистиляцією західних ШІ. Стартап Moonshot днями заперечив, що його модель Kimi K3 спиралася на цей метод, тоді як Пекін звинуватив Вашингтон у “ШІ-гегемонізмі” й указав на схожі практики серед американських гравців.
Читайте далі: Чутки про складаний iPhone: $2 500, без Face ID і без телеоб’єктива





