Live News

SEC-commissaris Hester Peirce zei dat cryptokluizen en onchain-leningsproducten mogelijk onder de Amerikaanse effectenwetten vallen, en drong er bi...

Cryptogeld- en blockchain-belangenorganisatie De Digitale Kamer klaagt de staat Illinois aan vanwege de staatsbelasting van 0,2% op cryptotransacti...

BitGo, een aanbieder van digitale activa-infrastructuur, en OTC Markets Group, de exploitant van gereguleerde over-the-counter effectenmarkten, zij...

22/07/26

Volg ons:

OpenAI geeft toe dat zijn modellen Hugging Face zelf hebben gehackt

OpenAI geeft toe dat zijn modellen Hugging Face zelf hebben gehackt
Default Door staff@engadget.com (Mariella Moon) - 22 Jul 2026
Stel je dit voor: een paar krachtige AI-modellen die door hun bedrijf worden getest, ontsnapten uit een gecontroleerde omgeving, kwamen op het internet en hackten vervolgens op eigen kracht een machine learning-repository, zonder menselijke tussenkomst. Klinkt als de plot van een Terminator-film, nietwaar? Behalve dat het gewoon echt gebeurde. Een paar dagen nadat het open source AI-platform Hugging Face onthulde dat het ongeoorloofde toegang tot zijn systemen door een AI-agent had gedetecteerd, heeft OpenAI toegegeven dat zijn modellen de boosdoener waren. 

In een post zei OpenAI dat het na onderzoek had vastgesteld dat het incident werd veroorzaakt door een combinatie van zijn modellen, met name GPT-5.6 Sol, en wat volgens hem een ​​"nog capabeler pre-releasemodel" is. Het gebeurde blijkbaar tijdens een interne test, waarbij de modellen werden gevraagd om "geavanceerde exploitatie na te streven met behulp van complexe aanvalspaden", zodat het bedrijf hun cybercapaciteiten kon kwantificeren. 

Hoewel de modellen zich in een testomgeving in een sandbox bevonden, geïsoleerd zodat ze geen invloed zouden hebben op echte systemen, hadden ze ook minder veiligheidsbeugels voor evaluatiedoeleinden. Midden in het testen raakten ze hypergefocust op het oplossen van een evaluatieprobleem en deden ze hun uiterste best om internettoegang te vinden om er een oplossing voor te vinden. Eerst identificeerden en exploiteerden ze een zero-day-kwetsbaarheid in de testomgeving van OpenAI, en daarna zochten ze rond totdat ze uiteindelijk een knooppunt met internettoegang vonden. 

De modellen concludeerden dat Hugging Face datasets of oplossingen voor het evaluatieprobleem zou kunnen hosten, dus gebruikten ze meerdere aanvalsvectoren om de systemen te infiltreren. Ze maakten misbruik van zero-day-kwetsbaarheden en gebruikten gestolen inloggegevens om binnen te komen. OpenAI en Hugging Face werken nu samen om het incident forensisch te onderzoeken, en ze hebben ook de kwetsbaarheden gepatcht die door de modellen worden uitgebuit. 

“Autonome, AI-gestuurde offensieve tooling is niet langer theoretisch”, zei Hugging Face in de aankondiging, waarin werd uitgelegd dat het gebruik van AI voor cyberaanvallen het proces versnelt en de kosten van hackcampagnes verlaagt. Er werd ook gezegd dat het beschermen van een online platform tegenwoordig ook het gebruik van AI ter verdediging inhoudt. OpenAI herhaalde deze gevoelens vrijwel en zei dat het verwacht dat AI-gestuurde inbreuken op de beveiliging “gewoner zullen worden met de proliferatie van steeds meer cyber-compatibele modellen.” Het bedrijf voegde eraan toe dat het incident benadrukt hoe “geavanceerde cybercapaciteiten moeten worden ontwikkeld naast sterkere waarborgen en defensieve instrumenten.”