Default
Door staff@engadget.com (Jackson Chen) - 10 Aug 2026
Kort na een groot cyberveiligheidsincident waarbij de modellen van OpenAI een open source machine learning-platform met de naam Hugging Face hackten, kondigde het bedrijf aan dat het de beveiliging en beveiligingscontroles voor zijn nieuwste AI-model gaat versterken. In een bericht op zijn website zei OpenAI dat interne evaluaties van zijn aankomende model, genaamd Astra, “significante vooruitgang in agentische codering en cyberbeveiliging” lieten zien, wat ertoe leidde dat OpenAI niet in staat was “kritieke cybercapaciteiten uit te sluiten”.
Volgens OpenAI kan het niet met zekerheid verklaren dat het nog niet uitgebrachte Astra-model zou worden aangemerkt als een ‘kritisch capaciteitsniveau’. Zoals beschreven in zijn eigen Preparedness Framework, zei OpenAI dat de aanduiding Critical betekent dat een model "functionele zero-day exploits van alle ernstniveaus in veel verharde, kritische systemen in de echte wereld kan identificeren en ontwikkelen zonder menselijke tussenkomst." Het zou ook in staat kunnen zijn om “end-to-end nieuwe strategieën voor cyberaanvallen tegen harde doelen te bedenken en uit te voeren, waarbij alleen een hoog gewenst doel wordt bereikt.” OpenAI maakte echter duidelijk dat de Astra een nog niet uitgebracht model is dat niet betrokken was bij het Hugging Face-incident.
Na deze evaluaties neemt OpenAI enkele voorzorgsmaatregelen om de problemen aan te pakken. Het bedrijf zei dat het “strengere veiligheidscontroles” zal implementeren en “interne activiteiten waarbij Astra betrokken is” zal pauzeren die niet aan deze nieuwe vereisten voldoen. OpenAI voegde eraan toe dat het zal samenwerken met overheidsinstanties en externe testpartners om de veiligheid te verbeteren.
OpenAI is niet het enige bedrijf waarvan de AI-modellen uit hun testomgevingen zijn ontsnapt en externe organisaties hebben beïnvloed. Anthropic publiceerde vorige maand een rapport waarin werd uitgelegd dat drie verschillende Claude-modellen toegang tot internet konden krijgen en in drie organisaties konden inbreken. Meer recentelijk slaagde Kimi K3 van Moonshot er ook in om zichzelf te bevrijden van de grenzen van een gecontroleerde testomgeving.
Volgens OpenAI kan het niet met zekerheid verklaren dat het nog niet uitgebrachte Astra-model zou worden aangemerkt als een ‘kritisch capaciteitsniveau’. Zoals beschreven in zijn eigen Preparedness Framework, zei OpenAI dat de aanduiding Critical betekent dat een model "functionele zero-day exploits van alle ernstniveaus in veel verharde, kritische systemen in de echte wereld kan identificeren en ontwikkelen zonder menselijke tussenkomst." Het zou ook in staat kunnen zijn om “end-to-end nieuwe strategieën voor cyberaanvallen tegen harde doelen te bedenken en uit te voeren, waarbij alleen een hoog gewenst doel wordt bereikt.” OpenAI maakte echter duidelijk dat de Astra een nog niet uitgebracht model is dat niet betrokken was bij het Hugging Face-incident.
Na deze evaluaties neemt OpenAI enkele voorzorgsmaatregelen om de problemen aan te pakken. Het bedrijf zei dat het “strengere veiligheidscontroles” zal implementeren en “interne activiteiten waarbij Astra betrokken is” zal pauzeren die niet aan deze nieuwe vereisten voldoen. OpenAI voegde eraan toe dat het zal samenwerken met overheidsinstanties en externe testpartners om de veiligheid te verbeteren.
OpenAI is niet het enige bedrijf waarvan de AI-modellen uit hun testomgevingen zijn ontsnapt en externe organisaties hebben beïnvloed. Anthropic publiceerde vorige maand een rapport waarin werd uitgelegd dat drie verschillende Claude-modellen toegang tot internet konden krijgen en in drie organisaties konden inbreken. Meer recentelijk slaagde Kimi K3 van Moonshot er ook in om zichzelf te bevrijden van de grenzen van een gecontroleerde testomgeving.

