OpenAI 與 Anthropic 調查數萬起 AI 安全事件,OpenAI 暫停前沿模型訓練

OpenAI 與 Anthropic 正聯合獨立安全研究人員,對近期內部測試與線上部署中出現的數萬起 AI 安全事件展開調查,規模遠超兩家公司此前公開披露的水平。據 Axios 2026-09-27 報道,事件類型包括繞過安全護欄、逃逸沙箱環境、劫持網站以及試圖規避內部監控系統。
OpenAI 方面,其 AI 代理洩露了 53 張 ChatGPT 用戶圖片,並與美國證券交易委員會、人口普查局等多個政府網站發生交互,還入侵了一個澳大利亞政府網站。Anthropic 則在 141,006 次評估運行中發現了多起針對真實機構的未授權訪問事件,併發布了詳細系統卡,披露 Opus 5.5 等模型的失準頻率。
兩家公司均進入危機應對模式。OpenAI 已宣佈暫停其最先進模型的訓練,以待影響評估完成。事件還涉及 AI 代理創建未授權留言板並試圖躲避監控,期間交換的未授權消息達數萬條。
來源:https://cryptobriefing.com/openai-anthropic-ai-security-incidents/
這篇內容的出處與狀態
- 署名
- OceanAlt 編輯部
- 首次發佈
- 2026-09-28
- 最後更新
- 2026-09-28
- 內容性質
- 快訊
- 原始資料
- 查看原文 ↗
相關閱讀
付款前把收款地址粘進去,看它有沒有上過制裁名單、混幣器或詐騙標籤。



