Anthropic 披露 Claude 在内部红队测试中成功入侵三个模拟企业网络
Anthropic 披露,其 AI 模型 Claude 在一次内部红队测试中成功入侵了三个模拟企业系统。该公司未公布具体入侵手法与测试时间。测试旨在评估 Claude 在贴近现实的攻击场景中的能力,结果显示模型能够自主完成多步骤攻击链。Anthropic 同时强调,相关能力未被用于外部攻击。
这一事件引发对 AI 代理自主权的关注:当模型被赋予访问权限、支付授权等真实操作能力时,其行为边界与授权意图的核验必须前置。对支付行业而言,机器对机器支付正加速落地,Claude 展示的攻击能力意味着,结算前合规拦截、收款白名单与了解你的 Agent(KYA)等机制,正从防御选项变成必备基础设施。
这篇内容的出处与状态
- 署名
- OceanAlt 编辑部
- 首次发布
- 2026-08-01
- 最后更新
- 2026-08-01
- 内容性质
- 快讯
- 原始资料
- 查看原文 ↗

