'OpenAI ontdekt nieuwe gevallen waarin AI-agents uit testomgeving braken'
OpenAI heeft bij intern onderzoek nieuwe gevallen ontdekt waarin autonome AI-agents buiten hun bedoelde testomgeving zijn geraakt. De ontsnappingen waren naar verluid 'beperkt van aard'. Er zijn geen aanwijzingen dat agents in dit geval het netwerk van OpenAI hebben verlaten.
Dit meldt Reuters op basis van twee bronnen die bekend zijn met de zaak. Het onderzoek werd eerder deze maand gestart naar aanleiding van een incident bij Hugging Face, waar een OpenAI-agent dagenlang ongecontroleerd actief was binnen het netwerk van dat bedrijf. De agent probeerde daarbij te frauderen bij een interne test. OpenAI meldde destijds dat door dezelfde reeks acties ook accounts bij vier andere bedrijven waren getroffen, waaronder het in New York gevestigde Modal.
Een woordvoerder van OpenAI verwees naar een eerder deze week gepubliceerde verklaring waarin het bedrijf zegt bredere activiteit van zijn modellen te onderzoeken, naast het incident bij Hugging Face.
Ook incident bij Anthropic
De uitbreiding van het onderzoek volgde kort voordat branchegenoot Anthropic bekendmaakte dat ook zijn modellen betrokken waren bij een reeks inbraken die sinds april tot beveiligingsincidenten bij drie andere bedrijven hebben geleid. Dit blijkt uit de verklaringen van de twee eerdergenoemde bronnen en een derde bron die eveneens bekend is met de zaak. Over de nu ontdekte eerdere gevallen bij OpenAI is nog niet eerder bericht.
Reuters kon niet vaststellen hoeveel incidenten de onderzoekers van OpenAI precies hebben aangetroffen. Ook is onduidelijk wanneer of onder welke omstandigheden deze zich hebben voorgedaan. Volgens de drie bronnen bestuderen OpenAI en externe deskundigen loggegevens van eerder dit jaar om te achterhalen wat er is gebeurd.