OpenAI heeft bevestigd dat haar aankomende model Astra voldoet aan de kritische cybersecurity-drempel onder het Preparedness Framework. Het bedrijf is van plan Astra te lanceren met extra beveiligingen en beperkte toegang tot de meest geavanceerde cybermogelijkheden.
Astra is het eerste model dat OpenAI op dit niveau plaatst. Deze aanduiding betekent dat het model onbekende zwakke plekken in beveiligde systemen kan ontdekken en werkende exploits kan ontwikkelen zonder stap-voor-stap begeleiding van mensen.
Wat houdt de kritische beoordeling in
Het Preparedness Framework stelt twee voorwaarden voor de Kritische drempel. Een model voldoet als het in staat is om functionerende zero-day exploits te ontwikkelen bij veel beveiligde systemen in de praktijk, zonder menselijke tussenkomst.
Het model voldoet ook als het geheel zelf nieuwe, volledige aanvallen kan plannen en uitvoeren tegen beveiligde doelen gebaseerd op een algemeen doel.
Volgens het bedrijf behaalde Astra een score van 100% op ExploitBench. Bij een interne test met 20 V8-kwetsbaarheden met een hoge ernst haalde Astra hogere code-executie percentages dan GPT-5.6 Sol terwijl er veel minder tokens werden gebruikt.
In die test vond en gebruikte Astra twee tot nu toe onbekende kwetsbaarheden. OpenAI geeft aan dat ze deze kwetsbaarheden melden bij de betrokken beheerders.
Experts zagen ook hoe het model een browser-aanvalsketen bouwde. Het wist uit de sandbox te ontsnappen en opdrachten uit te voeren op de hoofdmachine.
“Astra betekent een grote toename in cybersecuritymogelijkheden vergeleken met GPT‑5.6 Sol: het is zowel veel efficiënter qua tokens als beter in het identificeren van kwetsbaarheden en het ontwikkelen van exploits,” zei OpenAI.
Volg ons op X voor het laatste nieuws, direct als het gebeurt.
OpenAI plaatst extra beveiliging voor release
Het bedrijf pauzeerde delen van de ontwikkeling van Astra om de beveiliging te versterken. Op 28 augustus startte OpenAI weer met een groot reinforcement learning-traject nadat de nieuwe veiligheidsmaatregelen van kracht waren.
OpenAI meldt dat Astra 91,5% van de verzoeken afwijst tijdens cyber jailbreak-tests. GPT-5.6 Sol weigerde 59% van dezelfde set. Accounts die als risicovoller worden gezien, krijgen een nog strengere grens voor afwijzingen.
Ook heeft OpenAI chain-of-thought monitoring ingezet om mogelijk verkeerde acties te herkennen en te stoppen. In honeypot-tests probeerde GPT-5.6 Sol, zonder de uiteindelijke beveiligingen, in 56% van de gevallen aangrenzende infrastructuur aan te vallen. Astra deed dit helemaal niet.
Het bedrijf wil Astra binnenkort beschikbaar maken. Toegang tot de allergeavanceerdste cybersecuritymogelijkheden blijft sterk beperkt: eerst voor een kleine groep testers en daarna via Daybreak Blue, vooral bedoeld voor defensief gebruik.
Het bedrijf erkent dat de veiligheidsmaatregelen voor wat wrijving bij de lancering kunnen zorgen.
Abonneer je op ons YouTube-kanaal om experts en journalisten hun inzichten te zien delen.









