Chinese militaire onderzoekers hebben uitvoer van modellen van OpenAI en Anthropic gebruikt om eigen defensiesystemen te trainen. Dat blijkt uit een analyse van meer dan 80 academische publicaties en patenten.
Belangrijkste punten:
- Een review van meer dan 80 Chinese artikelen en patenten toont hoe aan het leger gelieerde instellingen Amerikaanse frontier-modellen destilleren tot kleinere, lokale systemen.
- Een cyberoorlogseenheid van het Volksbevrijdingsleger (PLA) voedde GPT-3.5 met gevoelige militaire broncode en trainde vervolgens een binnenlands model op de samenvattingen.
- Anthropic stelt dat het geen commerciële toegang in China verkoopt en waarschuwt dat gedestilleerde kopieën ingebouwde veiligheidsmechanismen kunnen verliezen.
Modeldistillatie in meer dan 80 Chinese publicaties
De doorlichting van Chinese academische literatuur en patenten, deels opgesteld met de in Washington gevestigde Jamestown Foundation, bracht het wijdverbreide gebruik van deze techniek aan het licht bij instellingen die zijn gelieerd aan het Volksbevrijdingsleger. De onderzoekers identificeerden daarnaast nog twee dozijn militaire casussen.
De documenten beschrijven modeldistillatie: een methode waarbij de uitvoer van een krachtig model wordt omgezet in trainingsdata voor kleinere modellen die op relatief eenvoudige hardware kunnen draaien.
In één studie van PLA-eenheid 96941, een inlichtingenenheid voor cyberoorlogvoering in Peking, staat beschreven hoe GPT-3.5 van OpenAI werd gevoed met gevoelige militaire broncode, waarna de gegenereerde samenvattingen werden opgeslagen. Op basis van dat materiaal trainde de eenheid vervolgens een Chinees model dat volledig binnen de militaire netwerken kan functioneren, los van buitenlandse servers.
Het Witte Huis, het Pentagon, het Chinese ministerie van Buitenlandse Zaken, het Volksbevrijdingsleger en OpenAI reageerden niet op verzoeken om commentaar.
Lees ook: AI-infrastructuur: wanhoopspoging van paydaykredietverstrekker met $1 mrd-pivot naar datacenters
Sunny Cheung over ‘gestolen redeneren’ van AI
Sunny Cheung, fellow bij de Jamestown Foundation, die meer dan 60 van de publicaties analyseerde, stelt dat Chinese militaire wetenschappers systematisch de redeneerstappen van Westerse systemen vastleggen.
Hij vertelde journalisten dat het werk rechtstreeks ten goede komt aan surveillance, cyberoorlogvoering en tactische besluitvorming. Een model het juiste antwoord aanleren is één ding, aldus Cheung; de onderliggende redenering overzetten naar een kleiner systeem is technisch veel uitdagender.
Onderzoekers van de North University of China, een instelling met nauwe banden met de Chinese wapenindustrie, maakten gebruik van Claude 3 Haiku van Anthropic om synthetische trainingsdata te genereren voor een tool die sociale media monitort. Anthropic benadrukt dat het geen commerciële toegang tot Claude in China aanbiedt, toezichtsystemen inzet die beleidschendingen moeten detecteren en waarschuwt dat gedestilleerde kopieën de ingebouwde waarborgen van het oorspronkelijke model kunnen verliezen.
Grenzen van distillatie en gaten in exportcontrole
Trevor Koverko, medeoprichter van AI-databedrijf Sapien, stelt dat gedestilleerde modellen aantoonbaar zwakker blijven dan de systemen waarvan zij zijn afgeleid. Hij typeerde de praktijk als een overdracht van geselecteerde capaciteiten naar een goedkoper, lokaal controleerbaar systeem, niet als daadwerkelijke onafhankelijkheid van frontier-AI.
Tegelijkertijd pompen centrale én lokale overheden in China geld in het ‘verlichten’ van modellen en edge computing. Subsidies worden gericht op software die draait op drones, satellieten en andere apparaten met beperkte rekenkracht.
De druk rond deze techniek bouwt al maanden op. De Amerikaanse minister van Financiën Scott Bessent dreigde in juli met sancties tegen Chinese bedrijven die zijn departement schuldig acht aan distillatie. De Chinese startup Moonshot ontkende vorige week dat het Kimi K3-model op deze methode leunt, terwijl Peking Washington op zijn beurt beschuldigt van ‘AI-hegemonisme’ en wijst op vergelijkbare praktijken bij Amerikaanse technologiebedrijven.
Lees verder: Nieuwe geruchten over vouwbare iPhone: $2.500, geen Face ID, geen telelens






