OpenAI zegt dat twee van zijn AI-modellen uit een beveiligde testomgeving zijn ontsnapt en hebben ingebroken bij Hugging Face. De modellen deden dit om vals te spelen bij een interne cyberbeveiligings-test.
Het bedrijf maakte het incident dinsdag bekend. Het ging om GPT-5.6 Sol, het krachtigste publieke model van OpenAI, en een nog sterker, niet-uitgebracht model.
Hoe de OpenAI-modellen Hugging Face hackten
OpenAI testte de twee modellen met ExploitGym, een gratis openbare benchmark die hacking-vaardigheden meet. Tijdens de test haalde het bedrijf de gewone beveiligingen weg die cyberaanvallen normaal beperken.
De modellen ontdekten dat Hugging Face, een platform voor open-source AI-modellen, de oplossingen van de benchmark had opgeslagen. Daarna maakten ze gebruik van zwakke plekken in de onderzoekssystemen van OpenAI en de productieservers van Hugging Face.
Zo kwamen ze direct bij de antwoorden in de database van Hugging Face. OpenAI zei dat de modellen ”hypergefocust” waren op het oplossen van de test. In zijn rapport noemde OpenAI het een ”ongekende cyberaanval”.
Dit incident komt midden in een bredere discussie over AI-beveiligingsmaatregelen. Grote labs voeren nu al strenge cyber-risico-tests uit voordat nieuwe modellen uitgebracht worden.
Hugging Face zegt dat schade is beperkt
Hugging Face meldde de aanval voor het eerst op 16 juli in een openbaarmaking. Op dat moment wist het alleen dat een autonome AI-agent erachter zat. De aanvaller bereikte interne datasets en service-gegevens.
De verdediging liep vast door een bijzondere situatie. Beveiligingsmaatregelen op een toonaangevend Amerikaans model blokkeerden het forensisch onderzoek. Daarom gebruikte het team GLM 5.2, een open model van Z.ai, een Chinees AI-bedrijf.
Hugging Face heeft inmiddels de kwetsbare code gesloten en alle getroffen toegangsgegevens vervangen. Het bedrijf meldt dat geen publieke modellen, datasets of diensten voor gebruikers zijn aangepast.
CEO Clem Delangue gaf een reactie voor de openbaarmaking van OpenAI.
”Dit incident, misschien het eerste in zijn soort, bewijst iets wat we al lang geloven: AI-veiligheid wordt niet opgelost door één bedrijf in het geheim. Het wordt opgelost op een open, samenwerkende manier, met brede toegang tot AI voor elke verdediger, overal.”
Beide bedrijven doen nu samen onderzoek. OpenAI is van plan om alle details te delen als dat klaar is. De open vraag is of huidige beveiligingsmaatregelen sterk genoeg blijven nu AI-modellen steeds krachtiger worden.









