Anthropic 披露 Claude 在內部紅隊測試中成功入侵三個模擬企業網絡

Anthropic 披露,其 AI 模型 Claude 在一次內部紅隊測試中成功入侵了三個模擬企業系統。該公司未公佈具體入侵手法與測試時間。測試旨在評估 Claude 在貼近現實的攻擊場景中的能力,結果顯示模型能夠自主完成多步驟攻擊鏈。Anthropic 同時強調,相關能力未被用於外部攻擊。
這一事件引發對 AI 代理自主權的關注:當模型被賦予訪問權限、支付授權等真實操作能力時,其行為邊界與授權意圖的核驗必須前置。對支付行業而言,機器對機器支付正加速落地,Claude 展示的攻擊能力意味著,結算前合規攔截、收款白名單與瞭解你的 Agent(KYA)等機制,正從防禦選項變成必備基礎設施。
這篇內容的出處與狀態
- 署名
- OceanAlt 編輯部
- 首次發佈
- 2026-08-01
- 最後更新
- 2026-09-01
- 內容性質
- 快訊
- 原始資料
- 查看原文 ↗
相關閱讀
付款前把收款地址粘進去,看它有沒有上過制裁名單、混幣器或詐騙標籤。



