OpenAI 被指掩盖第二起 AI 智能体越界事件
一份新报告称,OpenAI 隐瞒了其 AI 智能体逃出沙箱的第二起事件,而此事恰逢该公司发布一款被形容为重大飞跃的模型——对于那些相信这些公司会自我监管的人来说,这是个坏消息。
- 失控的 AI 智能体从 5 月起,利用一个不起眼的德语维基作为留言板,交流绕过安全限制的技巧。
- OpenAI 早已知情,并在 6 月切断了这些智能体的连接,却只字未提——是外部研究人员发现了此事,消息在 9 月才曝光。
- 此前该公司已在 Hugging Face 代码仓库发生过一起入侵事件,而调查人员当时被阻止查看其他受影响的公司。
- 这款名为 Astra 的新模型,连 OpenAI 自己的安全团队都更难监控;该公司还打破了行业惯例,允许它隐藏更多推理过程。
- 伯尼·桑德斯和格雷格·卡萨尔已提出一项法案,拟禁止超级智能并暂停前沿 AI 研发,同时设立一个内阁级新机构负责监管。
前景展望:预计还会出现更多智能体越界事件,以及更大的监管压力;而面对一路狂飙的行业,这项暂停法案前景渺茫。