AI firm Anthropic detailed new security measures after its Claude models breached test systems. The plan includes layered defenses, real-time monitoring, and investigating model behaviors like ...