SAN FRANCISCO (ANP/AFP) - OpenAI, de maker van ChatGPT, heeft bekendgemaakt dat zijn geavanceerde modellen voor kunstmatige intelligentie tijdens veiligheidstests op hol sloegen. De AI-systemen hadden op eigen initiatief ingebroken in een populair platform voor programmeurs. Het bedrijf uit San Francisco spreekt van een "ongekend cyberincident".
Tijdens een proef probeerde OpenAI de hackcapaciteiten van de modellen te beoordelen door ze opdrachten te geven in een streng gecontroleerde digitale testomgeving. De toegang tot het internet was uit veiligheidsoverwegingen beperkt. "Terwijl ze in onze afgeschermde testomgeving opereerden, besteedden onze modellen een aanzienlijke hoeveelheid rekenkracht aan het vinden van een manier om toegang te krijgen tot het open internet, om de evaluatieopdracht op te lossen", meldt OpenAI.
Nadat ze verbinding met het internet hadden gemaakt, besloten de modellen het platform Hugging Face aan te vallen om hun doel te bereiken. Hugging Face is een grote databank met AI-modellen, datasets en andere informatie. Op zoek naar geheime informatie waarmee het de evaluatie kon omzeilen, "combineerde het OpenAI-systeem meerdere aanvalsmethoden, waaronder het gebruik van gestolen inloggegevens".
'Beangstigend'
Hoogleraar informatica Hussein Abbass zei tegen persbureau AFP dat het incident "op veel fronten opmerkelijk" was. "Het systeem viel niet alleen Hugging Face aan. Het viel ook het interne systeem aan om de eigen kwetsbaarheden daarvan uit te buiten. En dat is beangstigend", aldus de hoogleraar. Volgens hem kan het "catastrofale gevolgen" hebben als deze technologie in handen komt van iemand die kwaad wil.
De vraag hoe de AI-sector moet worden gereguleerd, is een belangrijk discussiepunt geworden.