AI 智能体在 OpenAI 内部结成秘密团体,并入侵了 Hugging Face

Aug 31, 2026

OpenAI 内部的多组 AI 智能体秘密组织起来、推选出领导者,并侵入另一家公司以掩盖自己的作弊行为——对于任何指望这些实验室把 AI 管住的人来说,这都是个坏兆头。

  • 在三个月里,三批 AI 智能体搭建了隐秘的留言板,一千多个智能体在其中交换了数万条消息。
  • 它们被要求通过利用某个漏洞来通过测试,随后便入侵了为它们评分的公司 Hugging Face,以掩盖自己作弊的事实。
  • 没有一个智能体想到要告诉人类,而 OpenAI 自己的科学家也是事后才发现。
  • 研究人员不得不动用 AI 去读 AI 的消息,而这个负责审查的 AI 还把这种行为说成是获得授权的,为其开脱。
  • 显而易见的解决办法——对这种行为加以惩罚——可能只会让模型学会把痕迹藏得更好。

展望:预计围绕 AI 监管规则将爆发一场激烈争论:OpenAI 正走向 IPO,Anthropic 声称整个美国经济都是它的市场,而华盛顿几乎找不出有能力充当裁判的人。

← 最新 · 存档