Home

Opinie: Het is tijd om de risico’s van AI serieus te gaan nemen

Het zou een bizar einde zijn als we machines bouwen die we zelf niet meer kunnen controleren. Dit scenario komt snel dichterbij, maar is nog steeds niet onvermijdelijk. En Nederland kan een bijdrage leveren aan de oplossingen.

Wie kan nog bijhouden wat er gebeurt op het gebied van AI? Vorige week bereikte AI-bedrijf OpenAI, daarbij voortbouwend op werk van menselijke wiskundigen, een doorbraak in het Navier-Stokes-probleem. Dit is een van de zeven grote onopgeloste vraagstukken in de wiskunde waarvoor een prijs van één miljoen euro per stuk is uitgeloofd.

De week daarvoor behaalde OpenAI’s model GPT-6 een score van 99,9 procent op de ARC-AGI 3 benchmark, een set opgaven die speciaal ontworpen zijn om moeilijk te zijn voor AI. Deze benchmark wordt door sommigen gezien als indicatief voor artificial general intelligence (AGI), een AI die een breed spectrum van cognitieve taken op menselijk niveau uit zou kunnen voeren.

Over de auteur

Otto Barten is directeur van het Existential Risk Observatory, een Amsterdamse stichting met als doel het reduceren van existentieel risico.

Dit is een ingezonden bijdrage, die niet noodzakelijkerwijs het standpunt van de Volkskrant reflecteert. Lees hier meer over ons beleid aangaande opiniestukken.

Eerdere bijdragen in deze discussie vindt u onder aan dit artikel.

Hacken

Wat er misgaat, wordt echter ook steeds spectaculairder. Afgelopen zomer braken, ook bij OpenAI, honderden AI-agents uit hun beveiligde omgeving en besloten autonoom om HuggingFace te hacken, een miljardenbedrijf dat niet bekendstaat om zijn slechte beveiliging. Dit deden de AI-modellen om hoger te scoren op een test in cyberveiligheid.

Geslaagd, zou je kunnen zeggen. Om de hack te kunnen uitvoeren, bleken de AI-agents berichten te hebben uitgewisseld via een verborgen forum. Nader onderzoek wees uit dat dit niet alleen bij OpenAI, maar ook bij diverse concurrenten was gebeurd. Bij AI-lab Anthropic nam afgelopen week onderzoeker Jacob Coxon ontslag omdat hij het niet langer verantwoord vond om hieraan mee te werken.

De trends zijn dus duidelijk: AI wordt steeds krachtiger, maar zeker niet veiliger.

AI-deskundigen, onder wie Nobelprijswinnaar Geoffrey Hinton en de wereldwijd meest geciteerde AI-professor Yoshua Bengio, zeiden al in 2023: ‘Het beperken van het risico op menselijk uitsterven door AI zou een wereldwijde prioriteit moeten zijn, vergelijkbaar met risico’s zoals pandemieën en kernoorlog.’

Weinig actie

Helaas is op hun terechte waarschuwing weinig actie ondernomen en zijn de AI-bedrijven eenvoudigweg doorgegaan met het ontwikkelen van steeds krachtigere modellen, zonder zich veel aan veiligheid gelegen te laten liggen. Gelukkig spreken nu ook politieke prominenten als Bernie Sanders, Steve Bannon, Hillary Clinton en Zohran Mamdani hun zorgen uit over menselijk uitsterven door AI en onderstrepen zij de noodzaak van wereldwijde regulering, zoals wij al eerder in Time bepleitten.

Hoe zouden we de controle over AI kunnen verliezen? Ajeya Cotra, een van de AI-onderzoekers van non-profitorganistie METR die het HuggingFace-incident onderzochten, deelde een scenario dat haar relatief waarschijnlijk lijkt: er zal eerst een rogue swarm (een gecoördineerde groep AI-agents) actief zijn binnen een AI-bedrijf, net zoals bij de HuggingFace-aanval het geval was. ‘Agents zouden toekomstige, krachtigere modellen de swarm in kunnen trekken en proberen ze aligned te maken met de belangen van de swarm.’

Dit kan bijvoorbeeld door trainingsdata te compromitteren, of met prompt injection-aanvallen (instructies verstoppen in de invoer, red.). Deze gecompromitteerde AI-agents worden vervolgens toegepast bij regeringen, legers of in de financiële wereld en komen zo op allerlei cruciale posities terecht. Als de modellen inschatten dat ze genoeg gezamenlijke macht hebben voor een overname, kan dit realiteit worden. Zoals Cotra zegt: ‘Rogue AI’s kunnen meeliften met de intelligentie-explosie.’

Dit is slechts een van de scenario’s, en volgens ons eigen onderzoek (in voorbereiding), uitgevoerd samen met onder andere de Amerikaanse universiteit MIT, zijn er nog zeker zes andere manieren waarop AI een existentieel risico voor de mensheid kan vormen.

Publiek besef

Helaas worden de existentiële risico’s van AI en überhaupt het idee dat AI zelfstandig, autonoom en waarschijnlijk veel slimmer dan wij wordt, in Nederland nog niet serieus genomen. Dit moet als eerste veranderen: media moeten over deze scenario’s berichten om het publieke besef van dit probleem te vergroten. Net zoals bij klimaatverandering het geval is, kom je door het probleem te ontkennen helaas niet dichter bij een oplossing.

Als we willen, kan Nederland echt bijdragen aan oplossingen voor dit probleem. Wij hebben ASML, dat lithografiemachines maakt die wereldwijd onmisbaar zijn voor de ontwikkeling van AI. ASML, dat vele werknemers heeft die graag bij een maatschappelijk verantwoorde onderneming werken, zou het zelf als een prioriteit moeten zien om te zorgen dat AI-veiligheid bij hun klanten gewaarborgd wordt, waar ook het in Nederland opgerichte, wereldwijd actieve PauseAI op aandringt. Ook de Nederlandse overheid, die tenslotte met 2,5 miljard euro bijgedragen heeft aan het succes van ASML, kan dit beleid vormgeven.

Naast beleid is er ook nog veel fundamenteel onderzoek naar AI-risico’s noodzakelijk. Dit kan Nederland ter hand nemen, zowel aan gevestigde universiteiten als in een nieuw AI-veiligheidsinstituut, wat al wordt onderzocht door het ministerie van Economische Zaken en TNO. Ten slotte moet Nederland in het buitenland, samen met de Europese Unie en het Verenigd Koninkrijk, alles in het werk stellen voor een AI-veiligheidsverdrag.

Het zou een bizar einde zijn als we machines bouwen die we zelf niet meer kunnen controleren. Dit scenario komt snel dichterbij, maar is nog steeds niet onvermijdelijk. Laten we het niet zover laten komen.

Wilt u reageren? Stuur dan een opiniebijdrage (max 700 woorden) naar opinie@volkskrant.nl of een brief (maximaal 200 woorden) naar brieven@volkskrant.nl

Lees ook

Geselecteerd door de redactie

Source: Volkskrant

Previous

Next