De voormalige Google DeepMind-veiligheidsonderzoeker Bilal Chughtai waarschuwt dat kunstmatige intelligentie de mensheid kan uitroeien. Een andere ex-onderzoeker uit hetzelfde lab ziet binnen vijf jaar al een reëel risico op zware schade.
Belangrijkste punten:
- Chughtai vertrok in juli bij DeepMind en zegt dat superintelligentie binnen enkele jaren kan ontstaan.
- Hij stelt dat alignment-onderzoek fors achterloopt op de toename in rekenkracht en mogelijkheden, en pleit voor een gecoördineerde vertraging – geen volledige stop – van de AI-ontwikkeling.
- Voormalig DeepMind-onderzoeker Josh Engels ziet een risico op enorme schade binnen vijf jaar, terwijl kopstukken van Anthropic en OpenAI oproepen om de ontwikkelingssnelheid te temperen.
Chughtai waarschuwt voor AI-risico
Chughtai, die als research engineer werkte aan veiligheid en alignment rond artificiële algemene intelligentie, verliet DeepMind in juli en publiceerde deze week zijn waarschuwing.
Volgens hem kunnen AI-labs binnen enkele jaren superintelligente systemen bouwen die mensen op vrijwel elk terrein overtreffen, maar die tegelijkertijd moeilijk af te stemmen blijven op menselijke waarden en doelen.
De kern van het probleem is volgens Chughtai alignment. Hij schrijft: “Ik geloof oprecht dat AI de potentie heeft om ons allemaal te doden, en dat de tijd om dit te voorkomen begint op te raken.”
Huidige methoden om geavanceerde modellen betrouwbaar menselijke doelstellingen te laten nastreven, noemt hij “extreem rudimentair”. Tegelijkertijd nemen de mogelijkheden van zogeheten frontier-systemen veel sneller toe dan wetenschappers de alignment-problematiek kunnen doorgronden. Chughtai pleit niet voor een totale stop van AI-onderzoek. In plaats daarvan wil hij dat bedrijven hun wedloop afremmen, beter samenwerken en meer openheid geven over hoe grensverleggende modellen worden ontwikkeld en getest.
Zie ook: CLARITY Act Faces 60-Vote Senate Test As Opposition Grows
Anthropic scherpt veiligheidsfocus aan
De waarschuwing van Chughtai volgt op het vertrek van Jacob Coxon eerder deze maand, na drie jaar bij zowel Anthropic als OpenAI. Evan Hubinger, hoofd alignment science bij Anthropic, stelde later dat hij de kans dat AI de gehele mensheid uitroeit op meer dan 10% schat in de komende tien jaar.
Josh Engels, die eveneens op het veiligheidsteam van DeepMind werkte, zei op 12 september dat hij is overgestapt naar beoordelingsorganisatie METR, nadat hij aanbiedingen van Anthropic en OpenAI had afgewezen. Hij verwees daarbij naar een “angstaanjagende kans” op enorme AI-schade binnen vijf jaar.
Anthropic-CEO Dario Amodei roept al langer op om de groei van AI-capaciteiten te temporiseren. Die lijn wordt onderschreven door Sam Altman, topman van OpenAI, waardoor de discussie zich verbreedt onder de leidende AI-labs. De toenemende eensgezindheid is significant, omdat waarschuwingen nu niet alleen komen van vertrekkende veiligheidsexperts, maar ook van bestuurders die aan het roer staan van de belangrijkste AI-bedrijven.
De huidige alarmkreten markeren een abrupte wending vergeleken met begin 2022, toen Chughtai met AI begon te werken en de systemen nog aanzienlijk minder capabel waren dan de huidige frontier-modellen. In vier jaar tijd is het debat verschoven van langetermijntheorie over veiligheid naar concrete zorgen rond autonomie, alignment en de vraag of veiligheidsresearch het tempo van de capaciteitsgroei nog kan bijbenen.
Lees verder: Bitget's API Now Reaches Gold, Forex, Indices And Crude Oil

