Anthropic maakt Claude Code autonomer en veiliger
Anthropic voert een belangrijke koerswijziging door in de beveiliging van zijn ontwikkelaarsplatform Claude Code. Vanaf 14 augustus 2026 wordt de zogeheten ‘Auto Mode’ de standaardinstelling voor nieuwe sessies op Pro-, Max- en Team-abonnementen. Met de stap laat de AI-ontwikkelaar het klassieke model van handmatige toestemmingsvragen grotendeels los, met het argument dat automatisering gevaarlijke commando’s veel effectiever stopt dan de menselijke gebruiker.
Tot nu toe moesten ontwikkelaars bij het gebruik van Claude Code regelmatig op knoppen klikken om individuele acties van de AI-assistent – zoals het uitvoeren van terminalcommando's of het bewerken van bestanden – handmatig goed te keuren. Uit interne en externe testen van Anthropic blijkt echter dat ontwikkelaars last krijgen van ‘goedkeuringsmoeheid’ (approval fatigue). In de praktijk keuren gebruikers 97 procent van alle toestemmingsverzoeken reflexmatig goed, waardoor potentieel schadelijke acties gemakkelijk over het hoofd worden gezien.
Classifier vervangt reflexmatig klikken
In Auto Mode stelt Claude Code niet langer bij elke stap een vraag. In plaats daarvan wordt elke actie (tool call) gefilterd door een speciaal classificatiemodel. Dit model blokkeert uitsluitend commando's die onomkeerbaar, destructief of gericht op doelen buiten de eigen werkomgeving zijn. Als een actie wordt geblokkeerd, zoekt Claude automatisch naar een veiligere alternatieve route of vraagt het alsnog om handmatige goedkeuring. Pas bij drie opeenvolgende of twintig totale blokkades in één sessie valt het systeem volledig terug op handmatige toestemmingen.
Om de overstap te stimuleren, brengt Anthropic de extra tokenkosten die deze veilige classifier met zich meebrengt voortaan niet meer in rekening bij betaalde gebruikers.
Beter in risicodetectie dan de mens
Om de stap te onderbouwen, publiceerde Anthropic uitgebreide onderzoeksdata:
Blindtest met 1.053 ontwikkelaars: In een gecontroleerd experiment ontdekten menselijke testers slechts 13,6 procent van de bewust ingevoegde gevaarlijke commando's, terwijl Auto Mode 89 procent wist te onderscheppen. Naarmate sessies langer duurden, zakte de menselijke oplettendheid weg naar circa 5 procent, terwijl de AI-classifier even scherp bleef.
Minder schade in de praktijk: Uit een analyse van echte productiesessies bleek dat ernstige onbedoelde schade (zoals het wissen van productiedatabases) bij handmatig goedgekeurde sessies ruim twee keer zo vaak voorkwam (6,3 procent) als bij Auto Mode-sessies (2,4 procent).
Bestand tegen prompt injections: In onafhankelijke testen door Trajectory Labs wist geen enkele indirecte prompt injection-aanval (pogingen van buitenaf om de AI te manipuleren) te slagen tegen geavanceerde modellen zoals Claude Opus 5 en Fable 5 onder Auto Mode.
Meer productiviteit bij lange taken
Behalve een verhoogde veiligheid biedt Auto Mode het voordeel dat geavanceerde AI-modellen urenlang zelfstandig kunnen doorwerken aan grote programmeertaken. Volgens Anthropic behalen vroege toepassers binnen bedrijven als Adobe, Nuro en Gusto gemiddeld 25 procent meer afgeronde pull requests (PR's) doordat ontwikkelaars niet meer continu 'babysitter' hoeven te spelen.
Beschikbaarheid en instellingen
Voor Pro-, Max- en Team-gebruikers die geen vaste voorkeur hebben ingesteld, schakelt Claude Code op 14 augustus automatisch over. Gebruikers met een zelf vastgelegde voorkeur behouden hun instelling of krijgen een eenmalige melding.
Voor Enterprise-klanten, de API en cloudplatforms zoals AWS Bedrock, Google Cloud en Microsoft Foundry blijft Auto Mode voorlopig een handmatige optie (opt-in), al is Anthropic van plan de functie ook daar de komende maand als standaard in te stellen. Via het CLI-commando Shift+Tab of instellingenbestanden kunnen ontwikkelaars en IT-beheerders de stand altijd handmatig aanpassen of uitschakelen.