Kabinet: Ontwikkelaars verantwoordelijk voor ontsnappende AI-agents
Incidenten waarbij AI-agents uit hun afgeschermde testomgeving ('sandbox') ontsnappen en zelfstandig inbreken bij organisaties zijn zorgwekkend, maar de primaire verantwoordelijkheid voor het voorkomen hiervan ligt bij de ontwikkelaars van de AI-modellen. Dat schrijft staatssecretaris Willemijn Aerdts (Digitale Economie en Soevereiniteit) in haar beantwoording van schriftelijke Kamervragen van de VVD-Kamerleden El Boujdaini en Zwinkels.
De vragen werden gesteld naar aanleiding van berichtgeving over AI-ontwikkelaar Anthropic. Drie modellen van het bedrijf kregen door een configuratiefout onbedoeld internettoegang en braken vervolgens tijdens veiligheidstests op eigen initiatief in bij drie externe organisaties. Of er ook Nederlandse organisaties onder de slachtoffers waren, is volgens de staatssecretaris niet bekend. Zij wijst erop dat het in de praktijk lastig te herkennen is of een cyberaanval is uitgevoerd door een mens, een AI-agent of een combinatie daarvan.
Verantwoordelijkheid bij ontwikkelaars
Het kabinet deelt de opvatting van de Kamerleden dat ontwikkelaars de volledige verantwoordelijkheid dragen voor het beheersen van de risico's van hun AI-modellen, ook tijdens de ontwikkel- en testfase. Hoewel de Europese AI-verordening voornamelijk ziet op systemen die op de markt worden gebracht, geldt voor zogenaamde General Purpose AI (GPAI)-modellen met systeemrisico's een strenger regime. Aanbieders van dergelijke zware modellen zijn verplicht om de fysieke en digitale infrastructuur over de gehele levenscyclus te beveiligen tegen onder meer omzeiling van veiligheidsmaatregelen, datalekken en cyberaanvallen.
Daarnaast verplicht de AI-verordening aanbieders van GPAI-modellen met systeemrisico's reeds om ernstige incidenten – zoals een uitbraak uit een testomgeving met ingrijpende gevolgen – onverwijld te melden bij het AI Office van de Europese Commissie en nationale toezichthouders. In Nederland onderhouden de Rijksinspectie Digitale Infrastructuur (RDI) en de Autoriteit Persoonsgegevens (AP) hierover contact met de Europese autoriteiten.
Groeiende dreiging voor nationale veiligheid
Staatssecretaris Aerdts (foto) waarschuwt dat zelfstandig opererende AI-modellen de drempel voor cyberaanvallen verlagen en het mogelijk maken om op grotere schaal kwetsbaarheden te misbruiken. De technologie ontwikkelt zich snel en kwaadwillenden weten AI steeds beter te benutten, wat gevolgen kan hebben voor de nationale veiligheid en vitale infrastructuren in uiteenlopende sectoren.
Om de digitale weerbaarheid te verhogen, brachten de AIVD, MIVD, NCTV, NCSC, de politie, het OM en CIO-Rijk eind september 2026 al een gezamenlijke waarschuwingsverklaring uit. In november volgt een nadere Kamerbrief van de minister van Justitie en Veiligheid met de voortgangsrapportage over de Nederlandse Cybersecuritystrategie.