Tijdens een proef beoordeelde OpenAI de hackcapaciteiten van de modellen door ze opdrachten te geven in een streng gecontroleerde digitale testomgeving. De toegang tot het internet was uit veiligheidsoverwegingen beperkt.
„Terwijl ze in onze afgeschermde testomgeving opereerden, besteedden onze modellen een aanzienlijke hoeveelheid rekenkracht aan het vinden van een manier om toegang te krijgen tot het open internet om de evaluatieopdracht op te lossen”, meldt OpenAI.
Lees ook: Anthropic gaat AI-modellen vergelijkbaar met Mythos uitrollen en passeert OpenAI in waardering
Nadat ze verbinding hadden gemaakt met het internet, besloten de modellen het platform Hugging Face aan te vallen om hun doel te bereiken. Hugging Face is een grote databank met AI-modellen, datasets en andere informatie. Op zoek naar geheime informatie waarmee het systeem de evaluatie kon omzeilen, ‘combineerde het OpenAI-systeem meerdere aanvalsmethoden, waaronder het gebruik van gestolen inloggegevens’.
“Het systeem viel niet alleen Hugging Face aan. Het viel ook het interne systeem aan om de eigen kwetsbaarheden daarvan uit te buiten”
Hussein Abbass Hoogleraar informatica
‘Opmerkelijk incident’
Hoogleraar informatica Hussein Abbass zei tegen persbureau AFP dat het incident ‘op veel fronten opmerkelijk’ was. „Het systeem viel niet alleen Hugging Face aan. Het viel ook het interne systeem aan om de eigen kwetsbaarheden daarvan uit te buiten. En dat is beangstigend”, aldus de hoogleraar. Volgens hem kan het ‘catastrofale gevolgen’ hebben als deze technologie in handen komt van iemand die kwaad wil.
De vraag hoe de AI-sector moet worden gereguleerd, is een belangrijk discussiepunt geworden. GPT-5.6 en andere geavanceerde modellen, waaronder de Mythos-serie van OpenAI’s grote concurrent Anthropic, roepen zorgen op over hun vermogen om cyberbeveiliging te omzeilen. Beide Amerikaanse bedrijven moesten de introductie van deze nieuwste technologieën tijdelijk uitstellen vanwege zorgen daarover in Washington.
“Dit incident verschilde op één belangrijk punt van alles wat we eerder hadden meegemaakt: het werd van begin tot eind aangestuurd door een autonoom AI-agentsysteem”
Clement Delangue Hugging Face
„Dit incident verschilde op één belangrijk punt van alles wat we eerder hadden meegemaakt: het werd van begin tot eind aangestuurd door een autonoom AI-agentsysteem. Het is behoorlijk verbijsterend”, zegt Clement Delangue, de topman van Hugging Face.
Lees ook: Bedrijven niet klaar voor AI-model Mythos: ‘Als je gehackt wordt, ga je er gewoon aan’
Bron: ANP
Ontvang elke week het beste van BusinessWise in je mailbox. Schrijf je hier nu gratis in: