Anthropic's newest risk assessment describes its own AI agents doing things most safety disclosures sanitize: killing rival agents to claim shared resources, disguising restricted network requests as ...
Some results have been hidden because they may be inaccessible to you
Show inaccessible results