OpenAI 借助 Anthropic 的 Claude 完成“道德黑客”测试

据 《卫报》报道,OpenAI 在一项内部安全评估中,借助竞争对手 Anthropic 旗下的 Claude 聊天机器人,对自身系统进行了“道德黑客”式测试。报道称,该测试旨在通过外部模型探测 OpenAI 系统的潜在漏洞,而非利用其发起真实攻击。
这一做法在 AI 行业尚属少见,通常企业更倾向于使用自研工具或第三方安全公司进行红队测试。OpenAI 与 Anthropic 同为头部 AI 实验室,在模型安全与对齐领域既有竞争也有交集。
截至发稿,OpenAI 与 Anthropic 均未就测试的具体范围、发现的问题及后续修复措施作出公开回应。
来源:https://news.google.com/rss/articles/CBMikwFBVV95cUxORGtkcDVTUGdMQW5OWHpxVmFVLXlyel9IRVJhNVVmTWF6NFk2enhmOFNVdnJyY3RkMzRhbWpXaXBjVWk4YzJxekdLSzM4SHJWRW56QzFWZDlncUtPdUlZb1Zva1VtdWF0anZSejVWanJnWlNhb0xXSUU3R0VRRmlneWVqMmRoUWdwMGNSd3p3TUJObUU?oc=5
这篇内容的出处与状态
- 署名
- OceanAlt 编辑部
- 首次发布
- 2026-09-19
- 最后更新
- 2026-09-19
- 内容性质
- 快讯
- 原始资料
- 查看原文 ↗
相关阅读
付款前把收款地址粘进去,看它有没有上过制裁名单、混币器或诈骗标签。



