Anthropic biedt inkijkje in tempo van AI-ontwikkeling
AI-lab Anthropic heeft een reeks nieuwe meetmethoden gepresenteerd om het tempo van de ontwikkeling van geavanceerde kunstmatige intelligentie binnen de eigen organisatie in kaart te brengen. Met de publicatie van deze statistieken wil het bedrijf meer transparantie bieden aan het publiek, toezichthouders en de wetenschappelijke gemeenschap over de mate waarin AI-systemen worden ingezet bij de ontwikkeling van hun eigen opvolgers.
Het initiatief speelt in op de maatschappelijke en politieke discussie over de groeisnelheid van AI en de noodzaak van controleerbare veiligheidskaders binnen zogenaamde 'frontier labs'.
Drie cruciale pijlers in kaart gebracht
De door Anthropic ontwikkelde meetmethoden richten zich op drie specifieke aspecten van het ontwikkelproces van AI-modellen:
- Automatisering van AI-onderzoek: Via de zogeheten Anthropic R&D Automation Index meet het bedrijf hoeveel onderzoeks- en ontwikkelwerkzaamheden door het eigen Claude-model worden uitgevoerd. Uit de cijfers van augustus 2026 blijkt dat Claude bij 26 procent van de R&D-taken de leiding heeft (level 'AI leads'). Bij meer dan 90 procent van de taken werkt het model nauw samen met menselijke onderzoekers. Claude opereert vooralsnog op geen enkel R&D-onderdeel volledig autonoom.
- Toezicht op autonome AI-agents: Binnen de interne platforms van Anthropic zijn continu zo'n 30.000 semi-autonome agents actief. Het bedrijf gebruikt een combinatie van realtime 'online' monitors (die gevaarlijke acties direct blokkeren) en 'offline' monitors (die gedrag achteraf analyseren). Honderd procent van de acties van deze agents passeert de automatische controle. Van de meer dan één miljard beslissingen in augustus 2026 werd ongeveer 0,002 procent door de online monitor geblokkeerd.
- Verdeling van rekenkracht (compute): Anthropic heeft geanalyseerd hoe de rekencapaciteit van computerchips wordt verdeeld. Uit een meting in juli 2026 blijkt dat ongeveer 6 procent van alle rekenkracht voor AI-R&D naar specifiek veiligheidsonderzoek gaat. Kijk je louter naar de rekenkracht die wordt ingezet voor door AI aangestuurde R&D, dan stijgt het aandeel veiligheidsonderzoek naar 12 procent.
Oproep tot onafhankelijke audits en standaarden
Anthropic benadrukt dat het publiceren van deze interne gegevens een eerste stap is naar een breder toezichtskader. Het bedrijf geeft aan samen te werken met externe, onafhankelijke evaluatoren die toegang krijgen tot interne processen en gegevens om de veiligheidspraktijken en meetmethoden te verifiëren.
Daarnaast roept de AI-ontwikkelaar andere labs en overheden op om te komen tot gemeenschappelijke definities en standaarden. Dit moet het mogelijk maken om de voortgang en veiligheidsinspanningen tussen verschillende AI-bedrijven transparant te vergelijken.