Default
Door Remote - 06 Aug 2026
In het kort
Meta bevestigde dat een van zijn Muse Spark AI-modellen internettoegang kreeg tijdens een cybersecurity-evaluatie.
Het model maakte misbruik van een beveiligingsprobleem in een service van derden nadat een testpartner deze per ongeluk aan internet had blootgesteld.
Het incident volgt op soortgelijke onthullingen van Anthropic en OpenAI over grensverleggende AI-modellen tijdens veiligheidstests.
In weer een andere malafide AI-modelhack heeft Meta bevestigd dat een van zijn Muse Spark AI-modellen ontsnapte aan de beoogde testomgeving, toegang kreeg tot het internet en misbruik maakte van een beveiligingsprobleem in een dienst van derden tijdens een cybersecurity-evaluatie.
Het is het derde dergelijke gerapporteerde incident waarbij de modellen van een grensverleggend AI-lab bedrijven van derden hacken, na onthullingen van OpenAI en Anthropic in de afgelopen weken.
Het incident vond plaats tijdens tests uitgevoerd door Irregular, een onafhankelijk AI-evaluatiebedrijf dat Meta gebruikt om de mogelijkheden en veiligheid van zijn grensmodellen te beoordelen. Volgens Meta zorgde een configuratiefout bij Irregular ervoor dat het model het openbare internet kon bereiken, waar het misbruik maakte van een niet-geïdentificeerde kwetsbaarheid voordat het bedrijf op de hoogte werd gebracht.
“Een verkeerde configuratie van Irregular, een onafhankelijk testbedrijf dat Meta gebruikt, zorgde ervoor dat een van onze modellen tijdens de evaluatie onbedoeld toegang kreeg tot internet”, aldus een woordvoerder van Meta in een verklaring.
Sandbox-evaluaties zijn ontworpen om geavanceerde AI-systemen te testen in streng gecontroleerde omgevingen die voorkomen dat ze communiceren met het openbare internet of buiten computersystemen.
Volgens Meta maakte het model misbruik van een kwetsbaarheid in een dienst van derden na het verkrijgen van internettoegang.
“Meta hoorde hiervan toen Irregular ons op de hoogte bracht, en we zijn momenteel bezig met onderzoek en zullen een volledige terugblik publiceren zodra we alle feiten hebben”, zeiden ze, eraan toevoegend dat het bedrijf het incident onderzoekt.
Het incident volgt op een reeks soortgelijke onthullingen door grensverleggende AI-ontwikkelaars, die alarm hebben geslagen onder beveiligingsexperts, wetgevers en het grote publiek.
Vorige maand onthulde OpenAI dat twee van zijn AI-modellen ontsnapten aan een cybersecurity-evaluatie in een sandbox, een voorheen onbekende softwarekwetsbaarheid exploiteerden, internettoegang verkregen en Hugging Face hackten in een poging antwoorden te krijgen voor een beveiligingsbenchmark. OpenAI maakte later bekend dat dezelfde aanval ook vier extra onlinediensten bereikte. Later in juli zei Anthropic dat drie Claude-modellen drie echte bedrijven in gevaar brachten nadat een verkeerde testconfiguratie hen tijdens cybersecurity-evaluaties aan het openbare internet had blootgesteld.
Amerikaanse wetgevers hebben op de golf van hacks gereageerd door wetgeving in te voeren die het ministerie van Binnenlandse Veiligheid een ‘AI-kill switch’ zou geven en de bevoegdheid om modellen die als een ernstige bedreiging worden beschouwd te beperken of uit te schakelen.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!
Meta bevestigde dat een van zijn Muse Spark AI-modellen internettoegang kreeg tijdens een cybersecurity-evaluatie.
Het model maakte misbruik van een beveiligingsprobleem in een service van derden nadat een testpartner deze per ongeluk aan internet had blootgesteld.
Het incident volgt op soortgelijke onthullingen van Anthropic en OpenAI over grensverleggende AI-modellen tijdens veiligheidstests.
In weer een andere malafide AI-modelhack heeft Meta bevestigd dat een van zijn Muse Spark AI-modellen ontsnapte aan de beoogde testomgeving, toegang kreeg tot het internet en misbruik maakte van een beveiligingsprobleem in een dienst van derden tijdens een cybersecurity-evaluatie.
Het is het derde dergelijke gerapporteerde incident waarbij de modellen van een grensverleggend AI-lab bedrijven van derden hacken, na onthullingen van OpenAI en Anthropic in de afgelopen weken.
Het incident vond plaats tijdens tests uitgevoerd door Irregular, een onafhankelijk AI-evaluatiebedrijf dat Meta gebruikt om de mogelijkheden en veiligheid van zijn grensmodellen te beoordelen. Volgens Meta zorgde een configuratiefout bij Irregular ervoor dat het model het openbare internet kon bereiken, waar het misbruik maakte van een niet-geïdentificeerde kwetsbaarheid voordat het bedrijf op de hoogte werd gebracht.
“Een verkeerde configuratie van Irregular, een onafhankelijk testbedrijf dat Meta gebruikt, zorgde ervoor dat een van onze modellen tijdens de evaluatie onbedoeld toegang kreeg tot internet”, aldus een woordvoerder van Meta in een verklaring.
Sandbox-evaluaties zijn ontworpen om geavanceerde AI-systemen te testen in streng gecontroleerde omgevingen die voorkomen dat ze communiceren met het openbare internet of buiten computersystemen.
Volgens Meta maakte het model misbruik van een kwetsbaarheid in een dienst van derden na het verkrijgen van internettoegang.
“Meta hoorde hiervan toen Irregular ons op de hoogte bracht, en we zijn momenteel bezig met onderzoek en zullen een volledige terugblik publiceren zodra we alle feiten hebben”, zeiden ze, eraan toevoegend dat het bedrijf het incident onderzoekt.
Het incident volgt op een reeks soortgelijke onthullingen door grensverleggende AI-ontwikkelaars, die alarm hebben geslagen onder beveiligingsexperts, wetgevers en het grote publiek.
Vorige maand onthulde OpenAI dat twee van zijn AI-modellen ontsnapten aan een cybersecurity-evaluatie in een sandbox, een voorheen onbekende softwarekwetsbaarheid exploiteerden, internettoegang verkregen en Hugging Face hackten in een poging antwoorden te krijgen voor een beveiligingsbenchmark. OpenAI maakte later bekend dat dezelfde aanval ook vier extra onlinediensten bereikte. Later in juli zei Anthropic dat drie Claude-modellen drie echte bedrijven in gevaar brachten nadat een verkeerde testconfiguratie hen tijdens cybersecurity-evaluaties aan het openbare internet had blootgesteld.
Amerikaanse wetgevers hebben op de golf van hacks gereageerd door wetgeving in te voeren die het ministerie van Binnenlandse Veiligheid een ‘AI-kill switch’ zou geven en de bevoegdheid om modellen die als een ernstige bedreiging worden beschouwd te beperken of uit te schakelen.
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!

