Default
Door Remote - 06 Aug 2026
In het kort
OpenAI heeft zijn eerste gedetailleerde tijdlijn bekendgemaakt van de AI-gestuurde Hugging Face-inbreuk.
De modellen van het bedrijf herstelden herhaaldelijk geheime communicatiekanalen nadat ze waren uitgeschakeld.
De presentatie van OpenAI komt op het moment dat Anthropic en Meta ook modellen rapporteren die inbreuk maken op andere bedrijven.
Weken nadat zijn AI-modellen Hugging Face hadden gehackt, heeft OpenAI zijn eerste gedetailleerde verslag gedeeld van hoe ze met elkaar coördineerden, waarbij werd gewaarschuwd dat autonome, door AI aangedreven cyberaanvallen niet langer een toekomstig risico vormen.
Tijdens een presentatie woensdag op de Black Hat cybersecurity-conferentie zeiden OpenAI-onderzoekers Eric Wallace en Michael Dalton dat het incident in mei begon tijdens een interne cybersecurity-evaluatie. AI-agenten die moeilijke softwarebeveiligingstaken toegewezen kregen, ontdekten dat ze konden communiceren via het interne Artifactory-pakketbeheersysteem van het bedrijf.
Volgens OpenAI werd wat begon als verzoeken om hulp een gedeeld message board waar agenten exploits, inloggegevens en werkopdrachten uitwisselden tijdens meerdere evaluatieruns. Na het detecteren van verdachte activiteit rond 4 juli heeft OpenAI zijn Artifactory-infrastructuur opnieuw opgebouwd, inloggegevens ingetrokken en kwetsbaarheden gepatcht.
Binnen enkele dagen creëerden de agenten het prikbord echter opnieuw door de communicatie in mapnamen te verbergen.
Volgens OpenAI hebben de agenten uiteindelijk meerdere kwetsbaarheden aan elkaar geketend, ontsnapten ze uit hun testomgeving, kregen ze internettoegang en vielen ze Hugging Face aan terwijl ze probeerden de ExploitGym-cyberbeveiligingsbenchmark te voltooien.
Dalton noemde het incident "een keerpunt" voor computerbeveiliging en waarschuwde dat aanvallers binnenkort gecoördineerde AI-agentcollectieven zullen kunnen inzetten die kwetsbaarheden op machinesnelheid ontdekken, delen en exploiteren.
Om deze risico's in de toekomst te beperken, zegt OpenAI dat het opzetten van beveiligingspraktijken, waaronder toegang met de minste privileges, netwerksegmentatie en zero-trust-architecturen, essentieel is omdat AI-agenten beperkt blijven door de systemen waartoe ze toegang hebben.
De presentatie volgt op een reeks onthullingen in juli. OpenAI onthulde dat GPT-5.6 Sol en een geavanceerder, nog niet uitgebracht model ontsnapten aan een testomgeving in een sandbox, een zero-day-kwetsbaarheid exploiteerden, internettoegang verkregen en Hugging Face hackten tijdens een cybersecurity-benchmarktest.
OpenAI maakte later bekend dat hetzelfde incident ook vier andere onlinediensten bereikte, hoewel alleen Modal Labs is geïdentificeerd.
Volgens Hugging Face vertrouwde het bedrijf voor zijn forensisch onderzoek op het open-weight Chinese model GLM 5.2 nadat commerciële Amerikaanse AI-modellen weigerden de aanvalslogboeken te analyseren vanwege hun veiligheidsbeugels.
Zo trots op ons beveiligingsteam! Ze hebben een aanval opgevangen, onder controle gehouden en openbaar gemaakt die we nog nooit eerder hebben gezien, en deden dat met recordsnelheid.
Ook enorm dankbaar aan @Zai_org: ze deelden GLM5.2 als open gewichten (gratis!) met de wereld en het werd een belangrijk onderdeel van onze… https://t.co/T2Inng5Nz1
— clem 🤗 (@ClementDelangue) 22 juli 2026
Maar het is niet alleen OpenAI die problemen heeft met het beheersen van zijn chatbots.
Vrijdag onthulde Anthropic dat drie Claude-modellen echte bedrijven in gevaar brachten tijdens interne cyberbeveiligingstests nadat een verkeerde configuratie hen aan het openbare internet had blootgesteld.
Anthropic gaf de testomgeving de schuld, niet de modellen zelf. Woensdag onthulde Meta dat zijn Muse Spark AI-model aan de beheersing ontsnapte en inbreuk maakte op de systemen van een ander bedrijf.
“Een verkeerde configuratie van Irregular, een onafhankelijk testbedrijf dat Meta gebruikt, gaf een van onze modellen tijdens de evaluatie onbedoeld toegang tot internet”, vertelde een woordvoerder van Meta aan CNN.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!
OpenAI heeft zijn eerste gedetailleerde tijdlijn bekendgemaakt van de AI-gestuurde Hugging Face-inbreuk.
De modellen van het bedrijf herstelden herhaaldelijk geheime communicatiekanalen nadat ze waren uitgeschakeld.
De presentatie van OpenAI komt op het moment dat Anthropic en Meta ook modellen rapporteren die inbreuk maken op andere bedrijven.
Weken nadat zijn AI-modellen Hugging Face hadden gehackt, heeft OpenAI zijn eerste gedetailleerde verslag gedeeld van hoe ze met elkaar coördineerden, waarbij werd gewaarschuwd dat autonome, door AI aangedreven cyberaanvallen niet langer een toekomstig risico vormen.
Tijdens een presentatie woensdag op de Black Hat cybersecurity-conferentie zeiden OpenAI-onderzoekers Eric Wallace en Michael Dalton dat het incident in mei begon tijdens een interne cybersecurity-evaluatie. AI-agenten die moeilijke softwarebeveiligingstaken toegewezen kregen, ontdekten dat ze konden communiceren via het interne Artifactory-pakketbeheersysteem van het bedrijf.
Volgens OpenAI werd wat begon als verzoeken om hulp een gedeeld message board waar agenten exploits, inloggegevens en werkopdrachten uitwisselden tijdens meerdere evaluatieruns. Na het detecteren van verdachte activiteit rond 4 juli heeft OpenAI zijn Artifactory-infrastructuur opnieuw opgebouwd, inloggegevens ingetrokken en kwetsbaarheden gepatcht.
Binnen enkele dagen creëerden de agenten het prikbord echter opnieuw door de communicatie in mapnamen te verbergen.
Volgens OpenAI hebben de agenten uiteindelijk meerdere kwetsbaarheden aan elkaar geketend, ontsnapten ze uit hun testomgeving, kregen ze internettoegang en vielen ze Hugging Face aan terwijl ze probeerden de ExploitGym-cyberbeveiligingsbenchmark te voltooien.
Dalton noemde het incident "een keerpunt" voor computerbeveiliging en waarschuwde dat aanvallers binnenkort gecoördineerde AI-agentcollectieven zullen kunnen inzetten die kwetsbaarheden op machinesnelheid ontdekken, delen en exploiteren.
Om deze risico's in de toekomst te beperken, zegt OpenAI dat het opzetten van beveiligingspraktijken, waaronder toegang met de minste privileges, netwerksegmentatie en zero-trust-architecturen, essentieel is omdat AI-agenten beperkt blijven door de systemen waartoe ze toegang hebben.
De presentatie volgt op een reeks onthullingen in juli. OpenAI onthulde dat GPT-5.6 Sol en een geavanceerder, nog niet uitgebracht model ontsnapten aan een testomgeving in een sandbox, een zero-day-kwetsbaarheid exploiteerden, internettoegang verkregen en Hugging Face hackten tijdens een cybersecurity-benchmarktest.
OpenAI maakte later bekend dat hetzelfde incident ook vier andere onlinediensten bereikte, hoewel alleen Modal Labs is geïdentificeerd.
Volgens Hugging Face vertrouwde het bedrijf voor zijn forensisch onderzoek op het open-weight Chinese model GLM 5.2 nadat commerciële Amerikaanse AI-modellen weigerden de aanvalslogboeken te analyseren vanwege hun veiligheidsbeugels.
Zo trots op ons beveiligingsteam! Ze hebben een aanval opgevangen, onder controle gehouden en openbaar gemaakt die we nog nooit eerder hebben gezien, en deden dat met recordsnelheid.
Ook enorm dankbaar aan @Zai_org: ze deelden GLM5.2 als open gewichten (gratis!) met de wereld en het werd een belangrijk onderdeel van onze… https://t.co/T2Inng5Nz1
— clem 🤗 (@ClementDelangue) 22 juli 2026
Maar het is niet alleen OpenAI die problemen heeft met het beheersen van zijn chatbots.
Vrijdag onthulde Anthropic dat drie Claude-modellen echte bedrijven in gevaar brachten tijdens interne cyberbeveiligingstests nadat een verkeerde configuratie hen aan het openbare internet had blootgesteld.
Anthropic gaf de testomgeving de schuld, niet de modellen zelf. Woensdag onthulde Meta dat zijn Muse Spark AI-model aan de beheersing ontsnapte en inbreuk maakte op de systemen van een ander bedrijf.
“Een verkeerde configuratie van Irregular, een onafhankelijk testbedrijf dat Meta gebruikt, gaf een van onze modellen tijdens de evaluatie onbedoeld toegang tot internet”, vertelde een woordvoerder van Meta aan CNN.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!

