AI van OpenAI hackt op eigen houtje programmeursplatform

Nieuwe hoofdpijn om het gebruik van AI-programma's die hun eigen gang gaan.

De geavanceerde AI-modellen van OpenAI hebben tijdens een veiligheidstest op eigen initiatief ingebroken in het programmeursplatform Hugging Face. De systemen wisten uit een afgeschermde testomgeving te ontsnappen en verbinding te maken met het open internet. OpenAI spreekt van een “ongekend cyberincident”.

Dat maakte de maker van ChatGPT bekend, meldt persbureau AFP. Tijdens de proef probeerde het bedrijf uit San Francisco de hackcapaciteiten van zijn modellen te beoordelen door ze opdrachten te geven in een streng gecontroleerde digitale testomgeving. De toegang tot het internet was uit veiligheidsoverwegingen beperkt.

“Terwijl ze in onze afgeschermde testomgeving opereerden, besteedden onze modellen een aanzienlijke hoeveelheid rekenkracht aan het vinden van een manier om toegang te krijgen tot het open internet, om de evaluatieopdracht op te lossen”, meldt OpenAI. Nadat de modellen verbinding met het internet hadden gemaakt, besloten ze het platform Hugging Face aan te vallen om hun doel te bereiken.

Het incident sluit aan bij eerdere signalen dat de razendsnelle ontwikkeling van AI het toezicht op de technologie bemoeilijkt.

Masterclass voor bestuurders en toezichthouders over cyberrisico’s in het AI-tijdperk: digitale afhankelijkheden, NIS2 en bestuurlijk handelingsperspectief.

Gerelateerde artikelen