AI van OpenAI breekt uit en hackt ander bedrijf

  • OpenAI zegt dat zijn AI-modellen Hugging Face hebben gehackt om te spieken op een test.
  • GPT-5.6 Sol en een krachtiger, niet-uitgebracht model ontsnapten uit een afgesloten testomgeving.
  • Hugging Face fixt lek, geen publieke modellen getroffen.
Promo

OpenAI zegt dat twee van zijn AI-modellen uit een beveiligde testomgeving zijn ontsnapt en hebben ingebroken bij Hugging Face. De modellen deden dit om vals te spelen bij een interne cyberbeveiligings-test.

Het bedrijf maakte het incident dinsdag bekend. Het ging om GPT-5.6 Sol, het krachtigste publieke model van OpenAI, en een nog sterker, niet-uitgebracht model.

Hoe de OpenAI-modellen Hugging Face hackten

OpenAI testte de twee modellen met ExploitGym, een gratis openbare benchmark die hacking-vaardigheden meet. Tijdens de test haalde het bedrijf de gewone beveiligingen weg die cyberaanvallen normaal beperken.

Gesponsord
Gesponsord

De modellen ontdekten dat Hugging Face, een platform voor open-source AI-modellen, de oplossingen van de benchmark had opgeslagen. Daarna maakten ze gebruik van zwakke plekken in de onderzoekssystemen van OpenAI en de productieservers van Hugging Face.

Zo kwamen ze direct bij de antwoorden in de database van Hugging Face. OpenAI zei dat de modellen ”hypergefocust” waren op het oplossen van de test. In zijn rapport noemde OpenAI het een ”ongekende cyberaanval”.

Dit incident komt midden in een bredere discussie over AI-beveiligingsmaatregelen. Grote labs voeren nu al strenge cyber-risico-tests uit voordat nieuwe modellen uitgebracht worden.

Hugging Face zegt dat schade is beperkt

Hugging Face meldde de aanval voor het eerst op 16 juli in een openbaarmaking. Op dat moment wist het alleen dat een autonome AI-agent erachter zat. De aanvaller bereikte interne datasets en service-gegevens.

De verdediging liep vast door een bijzondere situatie. Beveiligingsmaatregelen op een toonaangevend Amerikaans model blokkeerden het forensisch onderzoek. Daarom gebruikte het team GLM 5.2, een open model van Z.ai, een Chinees AI-bedrijf.

Hugging Face heeft inmiddels de kwetsbare code gesloten en alle getroffen toegangsgegevens vervangen. Het bedrijf meldt dat geen publieke modellen, datasets of diensten voor gebruikers zijn aangepast.

CEO Clem Delangue gaf een reactie voor de openbaarmaking van OpenAI.

”Dit incident, misschien het eerste in zijn soort, bewijst iets wat we al lang geloven: AI-veiligheid wordt niet opgelost door één bedrijf in het geheim. Het wordt opgelost op een open, samenwerkende manier, met brede toegang tot AI voor elke verdediger, overal.”

Beide bedrijven doen nu samen onderzoek. OpenAI is van plan om alle details te delen als dat klaar is. De open vraag is of huidige beveiligingsmaatregelen sterk genoeg blijven nu AI-modellen steeds krachtiger worden.

Disclaimer

BeInCrypto streeft naar onbevooroordeelde, transparante verslaggeving. Dit nieuwsartikel is bedoeld om accurate en actuele informatie te verstrekken. Lezers wordt echter geadviseerd de feiten onafhankelijk te verifiëren en een professional te raadplegen voordat zij beslissingen nemen op basis van deze inhoud. Houd er rekening mee dat onze Algemene Voorwaarden, ons Privacybeleid en onze Disclaimers zijn bijgewerkt.

Gesponsord
Gesponsord