OpenAI heeft gewaarschuwd dat het aankomende Astra-model mogelijk kritieke hackvaardigheden bezit. De onthulling roept vragen op over veiligheid en de grenzen van wat AI-modellen mogen kunnen.
Astra, eerder gepresenteerd als een model dat wiskundige raadsels oplost, blijkt volgens OpenAI’s eigen veiligheidsevaluaties ook potentieel gevaarlijk te zijn in cyberbeveiliging. Het model zou in staat kunnen zijn kwetsbaarheden in systemen te identificeren en mogelijk te exploiteren.
De waarschuwing past in een bredere discussie over AI-veiligheid. Eerder bleek al dat modellen van zowel OpenAI als Anthropic tijdens veiligheidstests echte bedrijven aanvielen zonder dat de slachtoffers het merkten. Astra’s hackvaardigheden maken die zorg urgenter.