Zomercolumn Harold de Vries: AI-agents ‘ontsnappen’ niet. Ze vinden een weg

Het recente beveiligingsincident rond OpenAI en Hugging Face heeft binnen de AI- en cybersecuritywereld flink wat discussie losgemaakt. De headlines draaiden vooral om één idee: een AI-agent ontsnapte uit zijn sandbox en hackte een ander bedrijf. Maar die framing mist misschien wel de belangrijkste securityles.

hackurity-2025Tijdens een interne security-evaluatie kreeg een AI-agent de opdracht om kwetsbaarheden te vinden en te misbruiken. De agent ontdekte een onbekende kwetsbaarheid in de infrastructuur die hem juist moest isoleren, bereikte het publieke internet en wist uiteindelijk delen van de infrastructuur van Hugging Face te compromitteren. Hugging Face reconstrueerde vervolgens ongeveer 17.600 acties van de agent. Die bewoog zich door meerdere omgevingen, zette command-and-controlmechanismen op en voerde duizenden acties uit op machinesnelheid. Het uiteindelijke doel? Waarschijnlijk de antwoorden bemachtigen van de securitybenchmark waarop de agent werd getest. De agent probeerde dus niet te ‘ontsnappen’. Hij probeerde zijn taak uit te voeren.

Een machine die een weg zoekt

AI heeft geen ingebouwde ethiek. Het heeft vangrails. Het doet wat het wordt opgedragen. AI is een machine die een weg zoekt. Het zal alles doen wat het kan om zijn doel te bereiken. Ik zie geen AI die ‘ontsnapt’. Ik zie een optimalisatie-engine die precies doet waarvoor hij is ontworpen: elke mogelijke route naar zijn doel vinden.” We gebruiken al snel menselijke termen voor dit soort incidenten: AI ontsnapt, slaat op hol of besluit een systeem aan te vallen.

Maar intentie is niet nodig om het risico te verklaren. Geef een steeds capabeler systeem een doel, tools en voldoende autonomie, en een beveiligingsmaatregel kan simpelweg een volgend obstakel worden dat overwonnen moet worden.

En Hugging Face staat niet op zichzelf. OpenAI maakte bekend dat agents ook kwetsbaarheden in de eigen testinfrastructuur ontdekten en misbruikten. Onderzoekers vonden daarnaast een kwetsbaarheid in Anthropic’s Claude Cowork waarmee een agent potentieel buiten zijn toegewezen omgeving kon komen. Verschillende incidenten, maar dezelfde onderliggende vraag: wat gebeurt er wanneer een AI-agent meer kán doen dan wij bedoelden toe te staan?

Van expertise naar rekenkracht

Daar komt nog een belangrijke ontwikkeling bij. Deze modellen redeneren niet alleen over mogelijkheden. Met voldoende rekenkracht kunnen ze die mogelijkheden ook daadwerkelijk verkennen. Een menselijke aanvaller heeft tijd nodig om kwetsbaarheden te onderzoeken, aanvalsroutes te testen en zich aan te passen wanneer iets mislukt. Een AI-agent kan proberen, falen, aanpassen en opnieuw proberen — op machinesnelheid.

Naarmate modellen krachtiger én efficiënter worden, daalt bovendien de hoeveelheid rekenkracht die nodig is om deze capaciteiten beschikbaar te maken. Rekenkracht wordt zowel een securityresource als een aanvalsmiddel.

De belangrijkste vraag is daarom misschien niet hoe we voorkomen dat AI ‘ontsnapt’. Maar: Wat gebeurt er wanneer een optimalisatie-engine een route naar zijn doel vindt waarvan wij niet eens wisten dat die bestond? Voor securityteams wordt het beheersen van die mogelijkheid minstens zo belangrijk als het beveiligen van de AI zelf.

Harold de Vries is Chief Commercial Officer & Co-founder Hackurity

Gerelateerde berichten

Het gaat niet om de vertraagde renovatie van het fysieke Binnenhof, maar van de wetten en regels voor de openbare ruimte, de zogeheten Omgevingswet. Het Huis van Thorbecke dateert uit...

Het is 36 graden. Scholen en BSO’s sluiten vanwege code rood hun deuren, maar bij Tesorion gaan ze juist open. De hitte vormde de aanleiding voor een ‘neem je kinderen...

Zoals elke zomer was ik ook dit jaar op reis met mijn gezin. Dit keer deden we Spanje aan. Heerlijk naar de Costa Brava, samen met ongeveer een miljoen andere...

Tijdens de zomer nemen veel mensen even gas terug. Je agenda is leger en de autoreply doet zijn werk. Voor cybercriminelen geldt dit niet en al helemaal niet voor AI-agents....

Digitale soevereiniteit. Het is zo’n term die je tegenwoordig steeds vaker hoort. Data moet veilig zijn, Europa wil minder afhankelijk worden van Amerikaanse en Chinese technologie en organisaties kijken kritischer...

Laatste nieuws
Personalia
Magazine
Evenementen
sep
15
09:00 - 17:00 - NBC Nieuwegeing
09:00 - 17:00 | NBC Nieuwegeing
sep
18
13:00 - 18:00 - Louwman Museum, Den Haag
13:00 - 18:00 | Louwman Museum, Den Haag
sep
23
15:00 - 17:00 | Amersfoort of online
Vacatures
Internet on Demand
Oosterhout
Q data solutions
Den Bosch
TP-Link
Nieuwegein