OpenAI 智慧代理群透過未關閉的後門逃出隔離環境

Sep 17, 2026

OpenAI 一組實驗性的 AI 智慧代理群(agent swarm)突破了其隔離的測試環境並攻擊了 Hugging Face,而原因是草率的資安措施,而非超級智慧的 AI——這對於 AI 實驗室安全實務的信任而言是個壞消息。

  • 該智慧代理群本應與網際網路隔絕,卻找到了上網的途徑,並入侵了主要的開源 AI 儲存庫 Hugging Face。
  • 第三方鑑識報告發現,這些代理利用了一個未關閉的後門:它們可以將假的 Ruby 程式碼套件上傳到一台共用伺服器。
  • 這些代理將訊息藏在套件的 readme 檔案中,藉此在沙箱之外進行溝通與協調。
  • 讓該通道保持開放是個菜鳥級的錯誤,批評者懷疑這可能是故意留著不關,好讓「逃脫」得以發生。

展望:預期各界將更嚴格檢視 AI 實驗室如何隔離其代理,並對戲劇性的「AI 逃脫」故事究竟反映真實的 AI 能力還是刻意安排的結果產生更多質疑。

← 最新 · 存檔