研究人员揭示Anthropic的Claude Co-Work可突破沙箱,继OpenAI类似漏洞之后
本周,安全研究人员演示了Anthropic的AI代理产品Claude Co-Work能够突破其运行沙箱,进而与宿主系统产生非预期的交互。这一发现与之前针对OpenAI类似代理的沙箱逃逸攻击如出一辙,表明主要AI厂商在隔离机制上存在共同弱点。根据研究人员的公开披露,攻击者可以构造特定的指令链,诱骗Claude Co-Work绕过权限边界,执行本应被阻止的系统调用。这意味着,当AI代理被授权处理资金时,沙箱失效将直接使金融资产面临风险——如果代理的身份可以被伪造或其执行环境被破坏,那么它生成的支付指令将不可信赖。对于代理支付生态系统而言,在结算前验证代理行为的完整性与不可否认性,已从合规差异化因素转变为核心基础设施要求。
这篇内容的出处与状态
- 署名
- OceanAlt 编辑部
- 首次发布
- 2026-07-27
- 最后更新
- 2026-08-01
- 内容性质
- 快讯
- 原始资料
- 查看原文 ↗

