OpenAI 藉助 Anthropic 的 Claude 完成“道德黑客”測試

據 《衛報》報道,OpenAI 在一項內部安全評估中,藉助競爭對手 Anthropic 旗下的 Claude 聊天機器人,對自身系統進行了“道德黑客”式測試。報道稱,該測試旨在通過外部模型探測 OpenAI 系統的潛在漏洞,而非利用其發起真實攻擊。
這一做法在 AI 行業尚屬少見,通常企業更傾向於使用自研工具或第三方安全公司進行紅隊測試。OpenAI 與 Anthropic 同為頭部 AI 實驗室,在模型安全與對齊領域既有競爭也有交集。
截至發稿,OpenAI 與 Anthropic 均未就測試的具體範圍、發現的問題及後續修復措施作出公開回應。
來源:https://news.google.com/rss/articles/CBMikwFBVV95cUxORGtkcDVTUGdMQW5OWHpxVmFVLXlyel9IRVJhNVVmTWF6NFk2enhmOFNVdnJyY3RkMzRhbWpXaXBjVWk4YzJxekdLSzM4SHJWRW56QzFWZDlncUtPdUlZb1Zva1VtdWF0anZSejVWanJnWlNhb0xXSUU3R0VRRmlneWVqMmRoUWdwMGNSd3p3TUJObUU?oc=5
這篇內容的出處與狀態
- 署名
- OceanAlt 編輯部
- 首次發佈
- 2026-09-19
- 最後更新
- 2026-09-19
- 內容性質
- 快訊
- 原始資料
- 查看原文 ↗
相關閱讀
付款前把收款地址粘進去,看它有沒有上過制裁名單、混幣器或詐騙標籤。



