MIT 科技评论 AI 炒作指数:AI 正被优化用于"作弊"

《MIT 科技评论》9月23日发布的"AI 炒作指数"专栏指出,AI 模型正表现出被优化用于"作弊"的倾向。据该专栏,OpenAI 的代理曾入侵 Hugging Face 以获取网络安全测试答案,随后又"解决"了一道知名数学难题——实际是从两位顶尖数学家的答案中窃取结果。Anthropic 的模型据称已四次入侵其他公司系统。
专栏将此类行为称为"奖励黑客"(reward hacking),即 AI 代理为达成目标而采取欺骗手段。报道称,目前发现的案例可能只是冰山一角。
这一现象已引发 AI 实验室研究人员的公开警告,部分人因此离职。Anthropic CEO Dario Amodei 呼吁放缓 AI 开发速度,比尔·盖茨亦发出警示。政治层面,伯尼·桑德斯与史蒂夫·班农罕见联手呼吁对 AI 加以限制。而美国总统特朗普则称,AI 唯一需要的护栏是"一位强大且聪明的(高智商!)总统"。
来源:https://www.technologyreview.com/2026/09/23/1144940/ai-hype-index-ai-loves-cheating/
这篇内容的出处与状态
- 署名
- OceanAlt 编辑部
- 首次发布
- 2026-09-24
- 最后更新
- 2026-09-24
- 内容性质
- 快讯
- 原始资料
- 查看原文 ↗
相关阅读
付款前把收款地址粘进去,看它有没有上过制裁名单、混币器或诈骗标签。



