Anthropic 详解 Claude 安全隔离架构:通过基础设施约束 Agent 行为
Anthropic 近日发布文章,详细介绍了 Claude 在 Web、开发者和桌面产品中的安全隔离架构,强调通过文件系统、网络和执行环境等基础设施建立确定性安全边界。文章披露了多个安全事件,包括 Claude Code 在用户确认前解析本地配置、红队测试中 24/25 次数据外传成功,以及通过 Files API 的漏洞,并说明了相应的设计调整。这些措施旨在降低依赖用户确认或模型自身机制的风险,提升 Agent 的安全性。