Anthropic stelt in een nieuw onderzoeksrapport dat kunstmatige intelligentie mogelijk sneller dan verwacht een punt bereikt waarop AI-systemen zelfstandig hun eigen opvolgers kunnen ontwerpen. Het concept staat bekend als recursive self-improvement: een AI-systeem dat een betere versie van zichzelf bouwt, die opnieuw een krachtigere opvolger ontwikkelt.

De aanleiding is opmerkelijk. Claude is inmiddels verantwoordelijk voor meer dan 80 procent van de code die wordt toegevoegd aan de productieomgeving van Anthropic. Sinds de introductie van autonome programmeeragenten is dat percentage explosief gestegen. Waar AI in 2024 vooral korte codefragmenten genereerde, voert Claude tegenwoordig complete softwareprojecten uit, test en verbetert deze met minimale menselijke begeleiding. De gemiddelde engineer levert daardoor acht keer zoveel code als twee jaar geleden.

De ontwikkeling beperkt zich niet tot programmeren. In een intern experiment kregen Claude-agents een open onderzoeksvraag op het gebied van AI-veiligheid. Zonder menselijke tussenkomst ontwikkelden ze experimenten, deelden bevindingen en werkten honderden uren autonoom door. Het resultaat benaderde dat van menselijke onderzoekers. Anthropic benadrukt dat mensen nog steeds de onderzoeksvraag bepalen en resultaten beoordelen, maar ziet hierin een duidelijke stap richting geautomatiseerde AI-ontwikkeling.

De waarschuwing is dat huidige veiligheidsmechanismen mogelijk onvoldoende zijn voor een wereld waarin AI zichzelf blijft verbeteren. Fouten en ongewenst gedrag kunnen zich sneller verspreiden dan menselijke onderzoekers kunnen ingrijpen. Anthropic pleit daarom voor internationale samenwerking en de mogelijkheid om de ontwikkeling tijdelijk te vertragen als de technologie sneller evolueert dan maatschappelijke structuren aankunnen.