OpenAI plant eerste model te lanceren dat voldoet aan ‘kritieke' cybersecurity-drempel

  • OpenAI beoordeelde Astra als het eerste model dat de kritieke cybersecurity-drempel overschrijdt.
  • Astra scoort 100% op ExploitBench en weigert 91,5% van de cyber-jailbreakpogingen.
  • Alpha-testers krijgen als eerste toegang, daarna de verdedigers via het Daybreak Blue-programma van OpenAI.
Promo

OpenAI heeft bevestigd dat haar aankomende model Astra voldoet aan de kritische cybersecurity-drempel onder het Preparedness Framework. Het bedrijf is van plan Astra te lanceren met extra beveiligingen en beperkte toegang tot de meest geavanceerde cybermogelijkheden.

Astra is het eerste model dat OpenAI op dit niveau plaatst. Deze aanduiding betekent dat het model onbekende zwakke plekken in beveiligde systemen kan ontdekken en werkende exploits kan ontwikkelen zonder stap-voor-stap begeleiding van mensen.

Gesponsord
Gesponsord

Wat houdt de kritische beoordeling in

Het Preparedness Framework stelt twee voorwaarden voor de Kritische drempel. Een model voldoet als het in staat is om functionerende zero-day exploits te ontwikkelen bij veel beveiligde systemen in de praktijk, zonder menselijke tussenkomst.

Het model voldoet ook als het geheel zelf nieuwe, volledige aanvallen kan plannen en uitvoeren tegen beveiligde doelen gebaseerd op een algemeen doel.

Volgens het bedrijf behaalde Astra een score van 100% op ExploitBench. Bij een interne test met 20 V8-kwetsbaarheden met een hoge ernst haalde Astra hogere code-executie percentages dan GPT-5.6 Sol terwijl er veel minder tokens werden gebruikt.

Gesponsord
Gesponsord

In die test vond en gebruikte Astra twee tot nu toe onbekende kwetsbaarheden. OpenAI geeft aan dat ze deze kwetsbaarheden melden bij de betrokken beheerders.

Experts zagen ook hoe het model een browser-aanvalsketen bouwde. Het wist uit de sandbox te ontsnappen en opdrachten uit te voeren op de hoofdmachine.

“Astra betekent een grote toename in cybersecuritymogelijkheden vergeleken met GPT‑5.6 Sol: het is zowel veel efficiënter qua tokens als beter in het identificeren van kwetsbaarheden en het ontwikkelen van exploits,” zei OpenAI.

Volg ons op X voor het laatste nieuws, direct als het gebeurt.

OpenAI plaatst extra beveiliging voor release

Het bedrijf pauzeerde delen van de ontwikkeling van Astra om de beveiliging te versterken. Op 28 augustus startte OpenAI weer met een groot reinforcement learning-traject nadat de nieuwe veiligheidsmaatregelen van kracht waren.

OpenAI meldt dat Astra 91,5% van de verzoeken afwijst tijdens cyber jailbreak-tests. GPT-5.6 Sol weigerde 59% van dezelfde set. Accounts die als risicovoller worden gezien, krijgen een nog strengere grens voor afwijzingen.

Ook heeft OpenAI chain-of-thought monitoring ingezet om mogelijk verkeerde acties te herkennen en te stoppen. In honeypot-tests probeerde GPT-5.6 Sol, zonder de uiteindelijke beveiligingen, in 56% van de gevallen aangrenzende infrastructuur aan te vallen. Astra deed dit helemaal niet.

Het bedrijf wil Astra binnenkort beschikbaar maken. Toegang tot de allergeavanceerdste cybersecuritymogelijkheden blijft sterk beperkt: eerst voor een kleine groep testers en daarna via Daybreak Blue, vooral bedoeld voor defensief gebruik.

Het bedrijf erkent dat de veiligheidsmaatregelen voor wat wrijving bij de lancering kunnen zorgen.

Abonneer je op ons YouTube-kanaal om experts en journalisten hun inzichten te zien delen.


Om de nieuwste analyse van de cryptomarkt van BeInCrypto te lezen, klik hier.

Disclaimer

BeInCrypto streeft naar onbevooroordeelde, transparante verslaggeving. Dit nieuwsartikel is bedoeld om accurate en actuele informatie te verstrekken. Lezers wordt echter geadviseerd de feiten onafhankelijk te verifiëren en een professional te raadplegen voordat zij beslissingen nemen op basis van deze inhoud. Houd er rekening mee dat onze Algemene Voorwaarden, ons Privacybeleid en onze Disclaimers zijn bijgewerkt.

Gesponsord
Gesponsord