Live News

Net als de Galaxy S25 FE voelt de S26 FE meer aan als de Galaxy S26+ dan aan de S26, met een groter 6,7-inch display en een drietal camera's aan de...

Anthropic heeft volgens Reuters een biologisch onderzoekslaboratorium opgericht in de San Francisco Bay Area om fysieke experimenten uit te voeren...

Hier gaan we dieper in op wat deze apparaten kunnen doen en wat ze allemaal uniek maakt...

18/09/26

Volg ons:

Anthropic zegt dat Claude 26 procent van zijn AI-R&D-werk ‘leidt’

Anthropic zegt dat Claude 26 procent van zijn AI-R&D-werk ‘leidt’
Default Door staff@engadget.com (Ian Carlos Campbell) - 17 Sep 2026
Anthropic – nou ja, met name CEO Dario Amodei – heeft veel te zeggen over AI-veiligheid in de nasleep van de onthulling van OpenAI dat zijn AI-agenten Hugging Face hebben gehackt, en het heeft al enkele interessante details onthuld over hoe het daarbij werkt. In een nieuwe blog waarin meetstandaarden worden beschreven die volgens Anthropic AI-bedrijven kunnen helpen het tempo van de AI-ontwikkeling te communiceren, deelde Anthropic bijvoorbeeld dat zijn AI-chatbot Claude 26 procent van zijn AI-R&D-werk “leidt”.

Met ‘leads’ bedoelt het bedrijf nu dat de AI ‘het grootste deel van [een] taak end-to-end kan voltooien vanaf een prompt op hoog niveau, terwijl [een] mens toezicht houdt’, maar het is nog steeds een verrassende maatstaf. Het beweert ook dat AI nu op zijn minst “grote stukken werk onder nauwe menselijke leiding” doet op meer dan 90 procent van zijn onderzoek, inclusief de 26 procent die Claude leidt. Dat suggereert dat Claude het merendeel van het werk van Anthropic-werknemers doet, ook al zegt het bedrijf dat de chatbot “niet volledig autonoom opereert voor een afgemeten subset van AI R&D-werk.”

Anthropic kwam met deze statistieken op de proppen via de eerste van de drie voorgestelde metingen, die gericht zijn op ‘AI-geleide AI R&D’. Met behulp van een index van hoeveel van zijn AI-onderzoek en -ontwikkeling door Claude wordt uitgevoerd en een door Epoch AI ontwikkelde automatiseringsbeoordelingsschaal kon Anthropic een grafiek maken die het ‘automatiseringsniveau’ van Claude sinds augustus 2025 in kaart brengt, een proces waarvan wordt aangenomen dat elke maker van grensverleggende AI-modellen dit zou kunnen reproduceren met zijn eigen gegevens en de validatie van een derde partij.

Het bedrijf stelde ook manieren voor om het toezicht op AI-agenten te meten (hoeveel agentenactiviteit wordt gemonitord, hoe lang het duurt om te worden beoordeeld en hoe vaak agentgedrag wordt gemarkeerd) en om bij te houden hoeveel rekenkracht wordt besteed aan AI-R&D als andere manieren om te zien of de grensontwikkeling op het juiste tempo wordt uitgevoerd. De hoop is dat meer transparantie het gemakkelijker zou kunnen maken om te reageren op mogelijk uit de hand gelopen AI-ontwikkeling, of op zijn minst het publiek een duidelijker beeld zou kunnen geven.

Tot nu toe is het probleem er echter niet echt in geslaagd bedrijven het eens te laten worden over het idee om de ontwikkeling van AI te vertragen. OpenAI heeft al lippendienst bewezen aan het idee, en Anthropic heeft toegezegd externe beoordelaars de kans te geven zijn ontwikkelingspraktijken te beoordelen. Amodei's standpunt over AI-veiligheid zorgde er zelfs voor dat Elon Musk het eens werd over X. Of de AI-industrie met iets anders te maken heeft dan zelfregulering is veel onzekerder: president Donald Trump heeft de risico's van AI grotendeels gebagatelliseerd.