OpenAI lanceert Lockdown Mode voor ChatGPT, een nieuwe beveiligingslaag die prompt injection-aanvallen tegengaat. De functie blokkeert verdachte instructies en beperkt tegelijkertijd bepaalde mogelijkheden zoals live web browsing en beeldherkenning vanaf het web. Het is een bewuste keuze: veiligheid gaat boven functionaliteit.

Prompt injection blijft een van de grootste zwakke plekken van grote taalmodellen. Aanvallers kunnen verborgen instructies verbergen in ogenschijnlijk onschuldige tekst, foto’s of webpagina’s, waardoor het model ongewenste acties uitvoert. Lockdown Mode schakelt kanalen uit die voor dergelijke aanvallen vatbaar zijn, met als nadeel dat gebruikers minder gebruik kunnen maken van real-time zoek- en beeldmogelijkheden.

De release past in een bredere trend bij OpenAI om beveiliging te verharden. Eerder deze week combineerde het bedrijf Codex en ChatGPT tot één product, waarmee het ook agentic coderingsmogelijkheden centraliseerde onder strengere controles.