Chińscy wojskowi badacze wykorzystują wyniki generowane przez modele OpenAI i Anthropic do trenowania krajowych systemów obronnych – wynika z przeglądu ponad 80 prac naukowych i patentów.
Kluczowe ustalenia:
- Analiza ponad 80 chińskich publikacji i patentów wykazała, że instytucje powiązane z wojskiem destylują amerykańskie modele graniczne do mniejszych, lokalnych systemów.
- Jednostka cyberwojny PLA podała GPT-3.5 wrażliwy wojskowy kod źródłowy, a następnie wyszkoliła krajowy model na powstałych streszczeniach.
- Anthropic informuje, że nie sprzedaje komercyjnego dostępu w Chinach i ostrzega, że destylowane kopie mogą tracić oryginalne zabezpieczenia.
Destylacja modeli w ponad 80 chińskich publikacjach
Przegląd chińskich artykułów naukowych i patentów, przygotowany m.in. we współpracy z waszyngtońską Jamestown Foundation, ujawnił skalę stosowania tej praktyki w ośrodkach powiązanych z Chińską Armią Ludowo-Wyzwoleńczą. Analitycy zidentyfikowali dodatkowo około dwóch tuzinów studiów przypadku z udziałem jednostek wojskowych.
Dokumenty opisują destylację modeli – technikę, w której wyniki generowane przez potężny system służą jako dane treningowe dla mniejszych modeli, działających na skromniejszej infrastrukturze.
W jednej z prac naukowcy z jednostki 96941 PLA, odpowiedzialnej za wywiad wojskowy i operacje cybernetyczne w Pekinie, opisali podawanie GPT‑3.5 od OpenAI wrażliwego kodu źródłowego dotyczącego wojska oraz przechowywanie wygenerowanych streszczeń. Na tej bazie wyszkolono następnie krajowy model, który może działać wyłącznie w sieciach wojskowych Chin, bez odwoływania się do zagranicznych serwerów.
Biały Dom, Pentagon, chińskie MSZ, PLA oraz OpenAI nie odpowiedziały na prośby o komentarz.
Przeczytaj także: Infrastruktura AI, desperacki zwrot pożyczkodawcy chwilówek o 1 mld dol. w kierunku centrów danych
Sunny Cheung o przechwyconym rozumowaniu modeli
Sunny Cheung, analityk Jamestown Foundation, który przejrzał ponad 60 z tych publikacji, twierdzi, że chińscy wojskowi badacze systematycznie przechwytują etapy rozumowania zachodnich systemów AI.
Jak powiedział dziennikarzom, ta praca zasila systemy nadzoru, cyberwojny oraz narzędzia do podejmowania decyzji taktycznych. Według Cheunga nauczenie modelu poprawnej odpowiedzi to jedno, ale przeniesienie samego procesu rozumowania do mniejszego systemu jest znacznie trudniejsze.
Badacze z North University of China – uczelni powiązanej z chińskim przemysłem zbrojeniowym – wykorzystali model Claude 3 Haiku od Anthropic do tworzenia syntetycznych danych treningowych dla narzędzia monitorującego media społecznościowe. Anthropic podkreśla, że nie sprzedaje komercyjnego dostępu do Claude w Chinach, stosuje systemy monitorowania naruszeń zasad oraz ostrzega, iż destylowane kopie mogą pozbawiać modele wbudowanych zabezpieczeń.
Ograniczenia destylacji i luki w kontroli eksportu
Trevor Koverko, współzałożyciel firmy danych AI Sapien, ocenia, że destylowane modele pozostają słabsze od systemów, z których pochodzą. W komentarzu dla agencji określił tę praktykę mianem transferu wybranych zdolności do tańszego, lokalnie kontrolowanego systemu, a nie pełnym uniezależnieniem się od zachodnich modeli granicznych.
Równolegle rząd centralny i władze lokalne w Chinach finansują prace nad „odchudzaniem” modeli i przetwarzaniem brzegowym, kierując subsydia w stronę oprogramowania, które może działać na dronach, satelitach i innych urządzeniach o ograniczonych zasobach.
Napięcie wokół destylacji narasta od miesięcy. W lipcu sekretarz skarbu USA Scott Bessent zagroził sankcjami wobec chińskich firm, które jego resort uzna za winne stosowania tej techniki. Startup Moonshot w ubiegłym tygodniu zaprzeczył, by jego model Kimi K3 opierał się na destylacji, podczas gdy Pekin oskarża Waszyngton o „hegemonizm w AI” i wytyka podobne praktyki amerykańskim firmom technologicznym.
Zobacz również: Plotki o składanym iPhonie: 2 500 dol., bez Face ID i bez teleobiektywu





