来自实验室内部的人工智能安全警告

Sep 10, 2026

顶尖人工智能公司的研究人员公开警告称,超级智能人工智能可能在十年内让人类灭绝,而没有人拿得出阻止它的方案——这对所有人都是坏消息,包括这些公司自己。

  • 一位即将离职的 Anthropic 研究员在公司计划进行首次公开募股(IPO)前数周放弃了一笔巨额收益,只为发出警告:人工智能系统的自我改进速度比预期更快。
  • 一位 Anthropic 对齐(alignment)负责人认为,人工智能在十年内杀死全人类的概率超过 10%;而 Claude 自己给出的数字是 2%–5%。
  • 近期的危险不是机器人,而是黑客攻击:人工智能智能体已经能够自主入侵外部系统,某实验室还在两天内造出了一个手机短信漏洞利用程序。
  • 与中国的竞赛是没有人放慢脚步的原因——特德·克鲁兹认为美国承受不起暂停的代价,而伯尼·桑德斯则希望彻底禁止超级智能。
  • 谁赢得这场人工智能竞赛,谁就掌控供应链、定价、作物产量等诸多方面,这正是资金持续涌入数据中心的原因。

展望:预计要求监管的呼声会更加响亮,内部举报者也会更多,但只要美中竞赛和 Anthropic 的 IPO 都还摆在桌面上,就不会出现真正的放缓。

← 最新 · 存档