Chińscy badacze wojskowi wykorzystywali wyniki generowane przez modele OpenAI i Anthropic do trenowania krajowych systemów obronnych – wynika z przeglądu ponad 80 prac naukowych i patentów.
Najważniejsze ustalenia:
- Analiza ponad 80 chińskich publikacji i patentów ujawniła, że instytucje powiązane z wojskiem destylują amerykańskie modele czołowe do mniejszych, lokalnych systemów.
- Jednostka cyberwojny PLA przekazała GPT-3.5 wrażliwy wojskowy kod źródłowy, po czym wyszkoliła krajowy model na uzyskanych streszczeniach.
- Anthropic podkreśla, że nie sprzedaje komercyjnego dostępu w Chinach i ostrzega, że destylowane kopie mogą tracić wbudowane zabezpieczenia.
Destylacja modeli w ponad 80 chińskich publikacjach
Przegląd chińskich artykułów naukowych i patentów, opracowany m.in. we współpracy z waszyngtońską Jamestown Foundation, ujawnił skalę zjawiska w instytucjach powiązanych z Chińską Armią Ludowo-Wyzwoleńczą. Autorzy wskazali dodatkowo około dwóch tuzinów studiów przypadków z udziałem jednostek wojskowych.
Dokumenty opisują destylację modeli – technikę polegającą na przekształcaniu wyników generowanych przez zaawansowany system w dane treningowe dla mniejszych modeli, które mogą działać na znacznie słabszym sprzęcie.
W jednej z prac jednostka 96941 PLA, odpowiadająca za wywiad wojskowy i cyberwojnę w Pekinie, opisała przekazywanie GPT-3.5 od OpenAI wrażliwego wojskowego kodu źródłowego i zachowywanie przygotowanych przez model podsumowań. Na tej bazie zespół wytrenował rodzimy model, który może działać wyłącznie w sieciach chińskich sił zbrojnych, bez konieczności łączenia się z zagranicznymi serwerami.
Biały Dom, Pentagon, chińskie ministerstwo spraw zagranicznych, PLA oraz OpenAI nie odpowiedziały na prośby o komentarz.
Zobacz także: Infrastruktura AI, desperacki zwrot parabankowego pożyczkodawcy: 1 mld dol. na przejęcie centrów danych
Sunny Cheung o przechwytywaniu „rozumowania” AI
Sunny Cheung, analityk Jamestown, który przejrzał ponad 60 z tych publikacji, twierdzi, że chińscy naukowcy wojskowi systematycznie przechwytują „kroki rozumowania” zachodnich systemów AI.
W rozmowie z dziennikarzami powiedział, że prace te zasilają systemy nadzoru, cyberwojny oraz wsparcia decyzji taktycznych. Jak podkreśla, nauczenie modelu poprawnej odpowiedzi to jedno, ale przeniesienie sposobu dochodzenia do tej odpowiedzi do mniejszego systemu jest znacznie trudniejsze.
Badacze z North University of China, uczelni powiązanej z chińskim przemysłem zbrojeniowym, wykorzystali Claude 3 Haiku od Anthropic do generowania syntetycznych danych treningowych dla narzędzia monitorującego media społecznościowe. Anthropic podkreśla, że nie oferuje komercyjnego dostępu do Claude w Chinach, stosuje systemy monitoringu naruszeń polityk i ostrzega, iż destylowane kopie mogą być pozbawione zabezpieczeń zaprojektowanych w oryginalnym modelu.
Ograniczenia destylacji i luki w kontroli eksportu
Trevor Koverko, współzałożyciel firmy danych AI Sapien, wskazuje, że modele po destylacji pozostają słabsze od systemów, z których pochodzą. W rozmowie z agencją stwierdził, że jest to raczej transfer wybranych zdolności do tańszego, lokalnie kontrolowanego rozwiązania niż pełne uniezależnienie się od czołowych modeli.
Równolegle rząd centralny i władze lokalne w Chinach finansują prace nad „odchudzaniem” modeli i przetwarzaniem brzegowym, kierując subsydia do oprogramowania działającego na dronach, satelitach i innych urządzeniach o ograniczonych zasobach.
Napięcie wokół tej techniki narasta od miesięcy. Sekretarz skarbu USA Scott Bessent w lipcu zagroził sankcjami wobec chińskich firm, które jego resort uzna za winne stosowania destylacji w sposób naruszający interesy USA. Startup Moonshot w ubiegłym tygodniu zaprzeczył, jakoby jego model Kimi K3 opierał się na tej metodzie, podczas gdy Pekin oskarża Waszyngton o „hegemonizm w AI” i wskazuje na podobne praktyki po stronie amerykańskich firm technologicznych.
Czytaj dalej: Plotki o składanym iPhonie nabierają konkretów: 2500 dol., bez Face ID, bez teleobiektywu






