De voormalige Google DeepMind-veiligheidsonderzoeker Bilal Chughtai waarschuwt dat AI de mensheid zou kunnen uitroeien, terwijl een andere oud-onderzoeker van het lab verwacht dat ernstige schade al binnen vijf jaar mogelijk is.
Kernpunten:
- Chughtai vertrok in juli bij DeepMind en stelt dat superintelligentie binnen enkele jaren kan ontstaan.
- Hij zegt dat alignment-onderzoek ver achterblijft bij de snelle groei van capaciteiten en pleit voor een gecoördineerde vertraging, geen volledige stop.
- Voormalig DeepMind-onderzoeker Josh Engels ziet een risico op enorme schade binnen vijf jaar; bij Anthropic en OpenAI zijn prominente figuren die oproepen om de ontwikkeling te temporiseren.
Chughtai’s AI-waarschuwing
Chughtai, tot juli onderzoeksingenieur bij DeepMind en gespecialiseerd in veiligheid en alignment rond kunstmatige algemene intelligentie, publiceerde deze week zijn waarschuwing.
Volgens hem zouden AI-labs binnen enkele jaren superintelligente systemen kunnen bouwen die mensen in alle domeinen overtreffen, terwijl ze tegelijk moeilijk af te stemmen blijven op menselijke doelen.
Chughtai noemt alignment het kernprobleem en schrijft: “Ik geloof oprecht dat AI de potentie heeft om ons allemaal te doden, en dat we mogelijk weinig tijd hebben om dat scenario nog af te wenden.”
Hij stelt dat de huidige methoden om geavanceerde systemen betrouwbaar naar menselijke doelen te laten streven “buitengewoon rudimentair” zijn, terwijl toonaangevende AI-capaciteiten veel sneller verbeteren dan het begrip van alignment bij onderzoekers. Chughtai wil de ontwikkeling van AI niet stilleggen, maar pleit ervoor dat bedrijven de concurrentierace afremmen, hun inspanningen beter op elkaar afstemmen en veel meer openheid geven over hoe frontiermodellen worden ontworpen en getest.
Ook interessant: CLARITY-wet staat voor 60-stemmendrempel in Senaat te midden van groeiende tegenstand
Anthropic zet veiligheid hoger op de agenda
Chughtai’s waarschuwing volgt op het vertrek van Jacob Coxon eerder deze maand, na drie jaar bij zowel Anthropic als OpenAI. De verantwoordelijke voor alignment science bij Anthropic, Evan Hubinger, verklaarde later dat hij de kans groter dan 10% acht dat AI alle mensen kan doden in de komende tien jaar.
Engels, die eveneens op DeepMinds veiligheidsteam werkte, zei op 12 september dat hij zich heeft aangesloten bij de beoordelings-NGO METR, nadat hij aanbiedingen van Anthropic en OpenAI had afgewezen. Als reden noemt hij een “angstaanjagende kans” op enorme AI-schade binnen vijf jaar.
Anthropic-CEO Dario Amodei heeft bedrijven opgeroepen om de groei van AI-capaciteiten te doseren, een standpunt dat ook wordt gesteund door OpenAI-CEO Sam Altman, terwijl het debat zich uitbreidt onder de toonaangevende labs. Die consensus is betekenisvol, omdat de waarschuwingen nu zowel komen van vertrekkende veiligheidsonderzoekers als van topbestuurders van grote AI-bedrijven.
De huidige alarmkreten volgen op een snelle kentering sinds begin 2022, toen Chughtai aan AI begon te werken en de systemen nog veel minder capabel waren dan de huidige frontiermodellen. In vier jaar tijd verschoof de discussie van abstracte langetermijnveiligheid naar zeer concrete zorgen over autonomie, alignment en de vraag of veiligheidsonderzoek het tempo van de capaciteitsgroei nog kan bijbenen.
Lees ook: Bitget's API bereikt nu goud, forex, indices en ruwe olie

