OpenAI heeft zes nieuwe gevallen gemeld van onverwacht of zorgwekkend gedrag van zijn kunstmatige-intelligentiemodellen (AI). Het bedrijf komt met een plan om dergelijke incidenten voortaan bij te houden en openbaar te maken.
Enkele van de voorheen niet-gemelde incidenten hadden betrekking op modellen die informatie verborgen hielden of verzonnen, zo meldde OpenAI woensdag in een blogpost.
OpenAI geeft een aantal voorbeelden van de incidenten. Zo waren er modellen die instructies genereerden om opgelegde beperkingen te omzeilen, fouten verborgen hielden of informatie verzonnen.
Het bedrijf kondigde in het blog ook een nieuw systeem aan om gevallen van verkeerde afstemming van modellen aan te pakken. OpenAI wil dit soort incidenten beter opsporen, onderzoeken en openbaar maken.
OpenAI zegt dat de zes gevallen afzonderlijke incidenten zijn en geen beeld geven van hoe vaak dit soort gedrag voorkomt. Het bedrijf wil voortaan vaker dergelijke gevallen melden, ook als nog niet volledig duidelijk is wat de oorzaak is of hoe het gedrag kan worden voorkomen.
OpenAI-baas Sam Altman deelde zondag dat OpenAI, het bedrijf achter ChatGPT, dit jaar niet naar de beurs gaat. Altman sprak in een interview met Fortune van een "ongelukkig moment" omdat het bedrijf druk bezig is met het aanpakken van veiligheidsproblemen rond AI.
Source: Nu.nl economisch