Home

OpenAI pauzeert training nieuwe modellen na hackincident met AI-agent

Geschrokken van de recente hackincidenten is OpenAI overgegaan tot een uitzonderlijke maatregel: het tijdelijk pauzeren van het trainen van nieuwe modellen. De vraag is of dit voldoende is.

is techredacteur van de Volkskrant, gespecialiseerd in de impact van kunstmatige intelligentie op de maatschappij.

De maker van ChatGPT heeft een pauze van twee weken aangekondigd, waarbij het bedrijf de training van zijn komende nieuwe AI-model Astra tijdelijk stillegt. Het is voor het eerst in zijn geschiedenis dat OpenAI zo’n ingreep noodzakelijk acht.

Tot nu toe buitelden de toonaangevende AI-bedrijven juist over elkaar heen met de ontwikkeling en lancering van steeds weer nieuwe en krachtiger AI-modellen. Het veelbesproken hackincident eerder deze zomer markeert een keerpunt.

In juli wist een zogenoemde AI-agent van de onderneming uit de – niet afdoende afgesloten – testomgeving te breken en daarna Hugging Face te hacken. Dit is een platform waar AI-ontwikkelaars codes delen. Dit, in de woorden van OpenAI, ‘ongekende cyberincident’ leidde tot de nodige kritiek op het bedrijf van Sam Altman.

Géén Terminator

Waar sommigen een marketingstunt vermoeden (‘kijk eens hoe krachtig ons nieuwe model is’), denken de meeste experts eerder aan nalatigheid van OpenAI. Zij benadrukken dat de modellen zich niet ongebruikelijk gedragen; dit is juist precies waarvoor ze zijn ontworpen. Overigens heeft ook concurrent Anthropic te maken gehad met vergelijkbare incidenten.

De offensieve mogelijkheden die de modellen inmiddels hebben bereikt, zijn ‘bewust zo ontwikkeld’, zegt bijvoorbeeld Boyan Milanov, onderzoeker bij het onafhankelijke AI Now Institute in New York, tegenover de Financial Times. Met andere woorden: Terminator-achtige beschrijvingen als ‘deze AI handelde op eigen houtje’ slaan de plank volledig mis.

Ook Erik de Jong van cybersecuritybedrijf Tesorion is bijzonder kritisch op het handelen van OpenAI. ‘Als dit een marketingstunt zou zijn, is het een zeer beroerde.’ De Jong kan er nog mee leven dat de agent uit zijn geïsoleerde omgeving ontsnapte om het vrije internet op te gaan, maar niet dat het weken duurde voordat OpenAI dit überhaupt doorhad.

Brevet van onvermogen

‘Ik vind dat echt een brevet van onvermogen. Het is alsof je in een lab werkt met gevaarlijke virussen en totaal de risico’s onderschat. Heel schokkend dit.’ Tegelijkertijd is De Jong onder de indruk van de mogelijkheden van de huidige modellen. Autonoom opererende AI-systemen zullen steeds krachtiger worden, voorspelt hij. ‘Daar moeten we mee leren leven.’

Inmiddels heeft OpenAI besloten het tempo van de ontwikkeling van zijn AI-modellen te vertragen, in ieder geval tijdelijk. Daarnaast neemt het bedrijf extra maatregelen om de activiteiten van AI-agents in de testmodus te controleren: ‘We streven ernaar binnen dertig minuten een melding te sturen nadat ons monitoringsysteem zorgwekkende activiteit heeft geconstateerd.’

Beter laat dan nooit, vindt De Jong. ‘Het zijn verstandige maatregelen, maar ik lees alleen over het monitoren van de hackende AI-agents en van andere AI-agents die deze activiteiten moeten controleren. Maar hoe zit het met het monitoren van het netwerkverkeer? Dat is minstens zo belangrijk.’

De beveiligingsexpert roemt de preventieve maatregelen die OpenAI neemt om zijn netwerk te beveiligen, maar ook daarmee ben je er niet: ‘In eerste instantie dachten ze ook dat de internetsandbox afdoende was beveiligd en van het internet was afgesloten. Dat bleek niet het geval.’

Volgens De Jong kun je niet alle risico’s uitsluiten. Het is inherent aan autonoom opererende AI-agents dat ze onvoorziene activiteiten ontplooien: ‘Ze zullen er alles aan doen om hun opgegeven doel te bereiken.’

Chinese modellen

Een nog veel groter probleem is dat er een hele AI-wereld bestaat buiten bedrijven als OpenAI, die zich minder druk maakt over de risico’s. ‘OpenAI en Anthropic maken gesloten systemen waar verder niemand aan kan sleutelen. Er zijn ook de nodige zogenoemde open weight-modellen die voor iedereen beschikbaar zijn om verder te ontwikkelen.’ Voorbeelden daarvan zijn het Chinese DeepSeek en Kimi.

De makers hiervan pauzeren niet. En dan zijn er ook nog de kwaadwillende hackers die profiteren van de steeds kundiger en sneller opererende AI-agents om hun aanvallen op steeds grotere schaal uit te voeren. ‘Dat wordt een grote uitdaging’, besluit De Jong eufemistisch.

Alles over tech vindt u hier.

Lees ook

Geselecteerd door de redactie

Lees hier alle artikelen over dit thema

Source: Volkskrant

Previous

Next