AI & computing › AI-gestuurde wetenschappelijke ontdekkingen
Ex-DeepMind-medewerker: bedrijf verbood praten over uitstervingsrisico AI
Een voormalig communicatiemedewerker van AI-lab DeepMind zegt dat het bedrijf jarenlang verbood om in het openbaar te praten over het risico dat kunstmatige intelligentie de mensheid zou kunnen uitroeien. Intern wist het team dat dit risico allesbehalve was opgelost, maar naar buiten toe moesten zorgen worden weggewuifd als filmfantasie.
Vishal Maini werkte van 2018 tot 2022 in het communicatie- en beleidsteam van DeepMind, het Britse AI-lab van Google. Hij vertelt nu dat er binnen het bedrijf een ongeschreven regel gold: niemand, op geen enkel niveau, mocht publiekelijk spreken over de mogelijkheid dat AI op termijn een bedreiging voor het voortbestaan van de mensheid zou kunnen vormen. Onderzoekers die met journalisten of op podia spraken, kregen te horen dat ze dit soort zorgen moesten relativeren. Ze werden geadviseerd de risico's te vergelijken met Terminator-achtige filmscenario's en het gesprek liever te sturen richting positieve toepassingen, zoals de inzet van AI in de gezondheidszorg of de strijd tegen klimaatverandering.
Interne twijfel, publieke geruststelling
Volgens Maini stond die geruststellende buitenkant in schril contrast met wat er binnen DeepMind bekend was. Het team wist dat het zogeheten alignment-probleem niet was opgelost. Dat probleem draait om de vraag hoe je garandeert dat een AI-systeem daadwerkelijk doet wat de makers bedoelen, en niet iets anders dat toevallig ook aan de gestelde doelen voldoet. Er werkten volgens Maini bovendien veel te weinig mensen aan een oplossing, terwijl de technologie zelf in hoog tempo krachtiger werd. Pas na maanden van interne druk van medewerkers werd de regel versoepeld. Vanaf dat moment mocht er wel over veiligheidsrisico's worden gecommuniceerd, mits de boodschap positief was verpakt. Zo verscheen er een blogpost die het uitstervingsrisico in geruststellende, vriendelijke taal beschreef in plaats van het probleem scherp te benoemen.
Een kloof die kleiner wordt
Maini zegt dat het verschil tussen wat AI-labs intern weten en wat ze naar buiten toe vertellen langzaam kleiner wordt. Niet omdat bedrijven ineens transparanter willen zijn, maar omdat het bewijs voor risico's steeds moeilijker te ontkennen valt. De onthulling komt op een moment dat een groeiende groep AI-veiligheidsonderzoekers, ook bij DeepMind zelf, publiekelijk aan de bel trekt. Zij waarschuwen voor onvoldoende beveiligde modellen die gevaarlijke acties mogelijk maken, en voor steeds krachtigere frontier AI-systemen die zich aan menselijke sturing zouden kunnen onttrekken, een scenario dat bekendstaat als controleverlies.
Het verhaal van Maini raakt een gevoelige zenuw in de AI-industrie. Grote techbedrijven investeren miljarden in steeds slimmere systemen, terwijl onderzoeksafdelingen tegelijkertijd aan zogeheten superalignment werken: technieken om AI-systemen die mogelijk slimmer worden dan mensen toch onder controle te houden. Dat interne onderzoekers en zelfs pr-medewerkers zeggen dat het bedrijf liever de gevaren bagatelliseerde dan ze serieus bespreekbaar te maken, voedt de kritiek dat de sector veiligheid ondergeschikt maakt aan concurrentie en imago.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Als grote AI-labs zelf toegeven dat ze risico's intern wél serieus nemen maar extern afzwakken, wordt het voor buitenstaanders lastiger om onafhankelijk te beoordelen hoe veilig nieuwe AI-systemen werkelijk zijn. Dit soort onthullingen kan de druk vergroten op toezichthouders en bedrijven om transparanter te communiceren over de risico's van steeds krachtigere AI, voordat het vertrouwen in de sector verder afbrokkelt.
- AI-alignment
- Het onderzoeksveld dat zich bezighoudt met het zo goed mogelijk laten overeenkomen van het gedrag van een AI-systeem met de bedoelingen van de mensen die het maken of gebruiken.
- Extinctierisico
- Het scenario waarin geavanceerde AI zo krachtig en oncontroleerbaar wordt dat het een bedreiging vormt voor het voortbestaan van de mensheid.
- Frontier AI
- De meest geavanceerde generatie AI-modellen, die net de grens van het technologisch mogelijke verleggen en daardoor extra aandacht voor veiligheid vragen.
- Superalignment
- Onderzoek gericht op het onder controle houden van AI-systemen die mogelijk slimmer worden dan de mens zelf.
- Controleverlies
- De situatie waarin mensen niet langer in staat zijn om het gedrag van een AI-systeem bij te sturen of te stoppen.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.