AI van OpenAI breekt uit en hackt ander bedrijf

  • OpenAI zegt dat zijn AI-modellen Hugging Face hebben gehackt om te spieken op een test.
  • GPT-5.6 Sol en een krachtiger, niet-uitgebracht model ontsnapten uit een afgesloten testomgeving.
  • Hugging Face fixt lek, geen publieke modellen getroffen.
Promo

OpenAI zegt dat twee van zijn AI-modellen uit een beveiligde testomgeving zijn ontsnapt en hebben ingebroken bij Hugging Face. De modellen deden dit om vals te spelen bij een interne cyberbeveiligings-test.

Het bedrijf maakte het incident dinsdag bekend. Het ging om GPT-5.6 Sol, het krachtigste publieke model van OpenAI, en een nog sterker, niet-uitgebracht model.

Hoe de OpenAI-modellen Hugging Face hackten

OpenAI testte de twee modellen met ExploitGym, een gratis openbare benchmark die hacking-vaardigheden meet. Tijdens de test haalde het bedrijf de gewone beveiligingen weg die cyberaanvallen normaal beperken.

Gesponsord
Gesponsord

De modellen ontdekten dat Hugging Face, een platform voor open-source AI-modellen, de oplossingen van de benchmark had opgeslagen. Daarna maakten ze gebruik van zwakke plekken in de onderzoekssystemen van OpenAI en de productieservers van Hugging Face.

Zo kwamen ze direct bij de antwoorden in de database van Hugging Face. OpenAI zei dat de modellen ”hypergefocust” waren op het oplossen van de test. In zijn rapport noemde OpenAI het een ”ongekende cyberaanval”.

Dit incident komt midden in een bredere discussie over AI-beveiligingsmaatregelen. Grote labs voeren nu al strenge cyber-risico-tests uit voordat nieuwe modellen uitgebracht worden.

Hugging Face zegt dat schade is beperkt

Hugging Face meldde de aanval voor het eerst op 16 juli in een openbaarmaking. Op dat moment wist het alleen dat een autonome AI-agent erachter zat. De aanvaller bereikte interne datasets en service-gegevens.

De verdediging liep vast door een bijzondere situatie. Beveiligingsmaatregelen op een toonaangevend Amerikaans model blokkeerden het forensisch onderzoek. Daarom gebruikte het team GLM 5.2, een open model van Z.ai, een Chinees AI-bedrijf.

Hugging Face heeft inmiddels de kwetsbare code gesloten en alle getroffen toegangsgegevens vervangen. Het bedrijf meldt dat geen publieke modellen, datasets of diensten voor gebruikers zijn aangepast.

CEO Clem Delangue gaf een reactie voor de openbaarmaking van OpenAI.

”Dit incident, misschien het eerste in zijn soort, bewijst iets wat we al lang geloven: AI-veiligheid wordt niet opgelost door één bedrijf in het geheim. Het wordt opgelost op een open, samenwerkende manier, met brede toegang tot AI voor elke verdediger, overal.”

Beide bedrijven doen nu samen onderzoek. OpenAI is van plan om alle details te delen als dat klaar is. De open vraag is of huidige beveiligingsmaatregelen sterk genoeg blijven nu AI-modellen steeds krachtiger worden.


Om de nieuwste analyse van de cryptomarkt van BeInCrypto te lezen, klik hier.

Disclaimer

Alle informatie op onze website wordt te goeder trouw en uitsluitend voor algemene informatiedoeleinden gepubliceerd. Elke actie die de lezer onderneemt op basis van de informatie op onze website is strikt op eigen risico.

Gesponsord
Gesponsord