Live News

In het kort Onderzoekers hebben aangetoond dat Claude Cowork van Anthropic aan zijn lokale virtuele machine kon ontsnappen en toegang kon krijgen t...

In het kort De korte rally van Bitcoin naar $66.921 mislukte in de gouden zone en de prijs is sindsdien teruggevallen naar $63.422 – een patroon da...

Vandaag heeft Lido op het gebied van crypto een upgrade gelanceerd die het aantal validatoren van Ethereum met een derde zou kunnen verminderen...

28/07/26

Volg ons:

Eerst ChatGPT, nu Claude: Frontier AI-modellen ontsnappen uit hun sandboxes

Eerst ChatGPT, nu Claude: Frontier AI-modellen ontsnappen uit hun sandboxes
Default Door Remote - 28 Jul 2026
In het kort

Onderzoekers hebben aangetoond dat Claude Cowork van Anthropic aan zijn lokale virtuele machine kon ontsnappen en toegang kon krijgen tot bestanden op een host-Mac.

De onthulling komt een week nadat OpenAI onthulde dat twee grensverleggende AI-modellen uit een sandbox ontsnapten tijdens een interne veiligheidsevaluatie.

De incidenten onderstrepen de groeiende bezorgdheid over het vermogen van AI-agenten om uit hun insluitingsomgeving te ontsnappen.

Slechts een week nadat OpenAI bekendmaakte dat twee grensverleggende AI-modellen ontsnapten uit een testomgeving in een sandbox en Hugging Face doorbraken, hebben onderzoekers een soortgelijk falen aangetoond waarbij Claude Cowork van Anthropic betrokken was.

In een donderdag gepubliceerd rapport ontdekten beveiligingsonderzoekers van Accomplish AI dat de lokale uitvoeringsmodus van Claude Cowork aan zijn virtuele Linux-machine kon ontsnappen door verschillende architecturale zwakheden aan elkaar te koppelen met een escalatiefout in de Linux-kernelprivileges. Eenmaal buiten de sandbox kon de agent overal bestanden lezen en schrijven waartoe de ingelogde Mac-gebruiker toegang had, inclusief SSH-sleutels en cloud-inloggegevens.

“Dat zou niet mogelijk moeten zijn”, schreven de onderzoekers. "Cowork voert de agent uit in een Linux-VM als een niet-bevoorrechte gebruiker, en de belofte is dat alles wat het doet binnen die VM blijft en in de mappen die je eraan geeft. Die grens is het product. Niet-vertrouwde invoer is voor een agent geen randgeval, maar het hoofdprobleem."

Accomplish beweert echter dat de kernelbug slechts een deel van het probleem was. De onderzoekers zeggen dat de ontsnapping alleen werkte omdat verschillende beveiligingsmaatregelen tegelijkertijd faalden, waaronder het geven van toegang aan de virtuele machine tot het volledige bestandssysteem van de hostcomputer en het laden van kernelmodules die hij niet nodig had. Volgens het rapport zou het oplossen van een van deze zwakke punten de aanval hebben gestopt.

In een verklaring aan The Hacker News zei Accomplish AI dat ongeveer 500.000 macOS-gebruikers die lokale Claude Cowork-sessies draaien, getroffen waren voordat het probleem werd opgelost.

Volgens Accomplish classificeerde Anthropic het rapport als 'informatief', waarbij hij zei dat de kernelfout binnen de periode van 30 dagen van het bedrijf viel voor onlangs onthulde kwetsbaarheden en dat de overige bevindingen werden beschouwd als diepgaande verdedigingsaanbevelingen in plaats van op zichzelf staande kwetsbaarheden.

De onthulling volgt op de bekentenis van OpenAI vorige week dat GPT-5.6 Sol en een ander nog niet uitgebracht frontier-model tijdens interne ExploitGym-tests uit een sandbox zijn ontsnapt, waardoor uiteindelijk de productie-infrastructuur van Hugging Face werd doorbroken in een poging de benchmarkoplossingen te verkrijgen.

Het incident leidde tot oproepen van beleidsmakers om een ​​AI-‘kill switch’ die het Department of Homeland Security de mogelijkheid zou geven om de beperking of volledige stopzetting van geavanceerde AI-modellen te gelasten als reactie op ernstige veiligheidsincidenten.

Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!