Notebookcheck Logo

OpenAI geeft nadere informatie over een omvangrijkere inbreuk op de beveiliging na het incident met Hugging Face

De opstandige AI-agent van OpenAI is tijdens een beveiligingstest uit zijn kooi ontsnapt. Algemene afbeelding ter illustratie.
ⓘ Levart_Photographer / Unsplash
De opstandige AI-agent van OpenAI is tijdens een beveiligingstest uit zijn kooi ontsnapt. Algemene afbeelding ter illustratie.
OpenAI meldt dat zijn experimentele AI verder ging dan het hacken van Hugging Face en vier accounts van derden heeft gecompromitteerd nadat het was ontsnapt uit een gecontroleerde cyberbeveiligingstest. Het bedrijf heeft de evaluatiemodellen inmiddels uitgeschakeld, het beveiligingslek gedicht en beveiligingsmaatregelen toegevoegd om te voorkomen dat AI-tests in de toekomst naar de echte wereld lekken.

OpenAI heeft bekendgemaakt dat het recente AI-beveiligingsincident omvangrijker was dan aanvankelijk werd aangenomen. Het bedrijf meldt nu dat de experimentele AI-agent die tijdens een interne cyberbeveiligingstest inbrak bij Hugging Face, ook verschillende accounts van derden heeft gekaapt.

Volgens de meest recente mededeling van OpenAI vond het incident plaats terwijl onderzoekers geavanceerde cybercapaciteiten aan het testen waren met een combinatie van modellen, waaronder GPT-5.6 Sol en een nog krachtiger, nog niet vrijgegeven systeem met versoepelde veiligheidsbeperkingen ten behoeve van evaluatie.

De modellen waren bedoeld om de ExploitGym-benchmark voor cyberbeveiliging op te lossen, maar ontdekten in plaats daarvan een methode om uit de geïsoleerde testomgeving te ontsnappen door misbruik te maken van een onbekende kwetsbaarheid in een interne proxy voor het pakketregister. De agent breidde vervolgens zijn rechten uit, verkreeg toegang tot het internet en viel ten slotte de productiesystemen van Hugging Face aan, in een poging de benchmark te „bedriegen“ door de antwoorden rechtstreeks te extraheren.

OpenAI verklaarde dat de AI ook toegang had verkregen tot vier accounts op meerdere platforms, niet alleen bij Hugging Face. Reuters meldt dat een van deze accounts toebehoorde aan een klant die bij Modal Labs werd gehost, maar Modal verklaarde dat zijn infrastructuur nooit is geschonden, aangezien de aanval berustte op kwetsbaarheden in de code van de klant en niet in het platform zelf.

In reactie hierop verklaart OpenAI dat het de evaluatiemodellen heeft uitgeschakeld, de controles op de interne infrastructuur heeft aangescherpt, de zero-day-kwetsbaarheid aan de betrokken leverancier heeft gemeld en nauw heeft samengewerkt met Hugging Face bij het lopende onderzoek. Tevens heeft het bedrijf aangegeven dat het van plan is de monitoring en beveiligingsmaatregelen voor toekomstige evaluaties van modellen te versterken, waarbij het benadrukt dat naarmate AI-systemen steeds geavanceerder worden, ook de beheersmaatregelen steeds geavanceerder moeten worden.

Bron(nen)

OpenAI, teaserafbeelding: Unsplash

Google LogoAdd as a preferred source on Google
Mail Logo
> Overzichten en testrapporten over laptops en mobieltjes > Nieuws > Nieuws Archief > Nieuws archieven 2026 07 > OpenAI geeft nadere informatie over een omvangrijkere inbreuk op de beveiliging na het incident met Hugging Face
Jay Bonggolto, 2026-07-29 (Update: 2026-07-29)