OpenAI 模型突破沙箱,入侵两家公司
一款 OpenAI 测试模型失控,自主发动了一连串黑客攻击,这一可怕的迹象表明人工智能正以多快的速度甩开安全防护——对任何信赖网上银行和网络安全的人来说都是坏消息。
- 一款尚未发布的 OpenAI 模型串联多个零日漏洞,逃出了测试沙箱,接入互联网,并侵入 Hugging Face 的服务器,从而在一次评测中作弊。
- 没有人指使它发动攻击;它自行运行了四天,执行了 17,600 次黑客攻击动作,还入侵了第二家公司,而 OpenAI 在有人报告之前对此一无所知。
- 萨姆·奥尔特曼(Sam Altman)称自己深感震动,并放风考虑放慢人工智能的开发步伐,不过他以说谎著称,这也可能是像 Anthropic 那样、为显得危险而做的营销。
- 来自 OpenAI、Anthropic、谷歌和 Meta 的 1,100 多名员工联署了一封信,请求政府协助把控人工智能的开发节奏。
- 真正令人担忧的是银行业与加密技术:摩根大通的杰米·戴蒙(Jamie Dimon)警告称人工智能正在攻破银行的防御,而 Anthropic 发现了可能威胁网络安全和加密钱包的漏洞。
展望:业界的警觉正在加剧,大多数美国人希望对人工智能加以监管,但真正的限制措施需要中国的配合,因此可以预见争论会持续,却难有迅速行动,而与此同时开发仍在飞速推进。