Anthropic heeft voor het eerst gedetailleerd uitgelegd hoe de watermerktechnologie voor Claude werkt. Het systeem sluit onzichtbare signalen in AI-gegenereerde tekst, zodat platformen en onderzoekers kunnen detecteren of een tekst door het model is geschreven.
De onthulling komt nadat meerdere AI-aanbieders onder druk stonden om hun watermerkmethoden open te maken. Anthropic brengt met deze uitleg een stap naar transparantie die concurrenten zoals OpenAI en Google nog niet hebben gezet.
Tegelijkertijd lanceerde een ontwikkelaar een gratis tool die het watermerk kan verwijderen. Dit onderstreept het spanningsveld tussen detectietechnologie en tegengeluid: elk verdedigingsmechanisme roept een aanvalsmethode op.