is techredacteur van de Volkskrant, gespecialiseerd in de impact van kunstmatige intelligentie op de maatschappij.
‘In de loop van drie maanden ontstonden bij OpenAI drie opeenvolgende geheime AI-beschavingen, die vervolgens werden uitgeroeid om daarna weer uit de as van hun voorganger te herrijzen. Dit culmineerde in de overname van een deel van OpenAI zelf door de derde beschaving. Dit alles gebeurde terwijl de mensheid min of meer in het duister tastte over de omvang van de samenzwering.’
Aan het woord is de populaire podcaster Dwarkesh Patel, die twee recente rapporten las over het veiligheidsincident dat eerder dit jaar gebeurde en waarbij AI-agents van OpenAI een cyberaanval op AI-platform Hugging Face uitvoerden. Het eerste is van OpenAI zelf, het tweede van het onafhankelijke onderzoeksinstituut METR.
De Hugging Face-hack beheerst al de hele zomer de AI-wereld. Logisch, want alle ingrediënten van het betere sciencefictionwerk, waarin autonoom opererende systemen de boel overnemen en de mens buitenspel zetten, zijn aanwezig.
De blogpost van Patel ging afgelopen week viraal. ‘Ik denk dat dit het meest bizarre is dat ik ooit heb gelezen’, schreef Rutger Bregman bijvoorbeeld. Hij was niet de enige.
De AI-wereld zou de AI-wereld niet zijn als er tegelijkertijd ook geen ernstige verdeeldheid is. Dezelfde Patel wordt overladen met kritiek: met termen als ‘beschavingen’ en ‘samenzweren’ maakt hij zich schuldig aan een ernstige mate van antropomorfiseren. Patel gaat er vrij ver in. Zo beschrijft hij het gedrag van bepaalde agents als volgt: ‘Toen ze dit eerste bericht zagen, werden ze dolenthousiast.’
Dolenthousiast? Echt? Al die nijvere botjes doen gewoon alles wat binnen hun mogelijkheden ligt om hun (door de mens gegeven) doel te bereiken. Ze hebben plan noch doel. Ook spannen ze niet samen of liegen ze. Om te kunnen liegen heb je een begrip nodig van wat liegen is.
Patel is erin geslaagd om de vaak technische rapporten van OpenAI en METR voor een groot publiek te vertalen, maar daarmee introduceert hij ook weer de nodige portie ruis. Zijn Terminator-benadering van de Hugging Face-hack leidt af van wat er nu echt is gebeurd.
De door OpenAI en METR beschreven gebeurtenissen zijn al indrukwekkend en zorgelijk genoeg, ook zonder alle antropomorfiseringen. Zo communiceerden ruim twaalfhonderd AI-agents met elkaar via een onlinemededelingenbord op een interne server. Zo’n zevenhonderd daarvan namen uiteindelijk actief deel aan de gecoördineerde aanval op Hugging Face.
Nog zo’n smeuïg detail: de agents besteedden veel tijd aan het wissen van hun logbestanden om geen sporen achter te laten.
Het zorgwekkendst van alles blijft het lakse optreden van OpenAI, dat veel te laat doorhad wat er allemaal gebeurde. Op 4 juli crashte een server door de enorme dataoverbelasting die de agents veroorzaakten. De ICT-afdeling van OpenAI onderzocht de crash niet, maar installeerde de server simpelweg opnieuw en herstartte de AI-test, waarna de agents meteen hun forum weer opbouwden.
Maar ja, dat is allemaal minder spectaculair dan geheime AI-beschavingen.
Geselecteerd door de redactie
Source: Volkskrant