首頁LBank 新聞中心
OpenAI 對抗失控代理與駭客的答案是更多 AI,而不是更少
openai-answer-rogue-agents-hacks-more-ai
OpenAI 對抗失控代理與駭客的答案是更多 AI,而不是更少
OpenAI總裁Greg Brockman的新文章引用了公司對Hugging Face的駭入事件,以推動迫切的AI驅動防禦。
2026-08-17 來源:decrypt.co

簡報

  • OpenAI 總裁 Greg Brockman 於 8 月 17 日發表「防禦者的視窗」(The Defender's Window)一文,
  • 該文章敦促企業立即部署 AI 安全代理,並稱 OpenAI-Hugging Face 洩漏事件為「網路安全的分水嶺時刻」。
  • 在美國商業 AI 拒絕提供幫助後,Hugging Face 團隊動用 Z.ai 的開放權重 GLM 5.2 來調查 OpenAI 的駭客入侵事件。

OpenAI 希望每個安全團隊立即開始運行 AI 代理。總裁 Greg Brockman 週一發表了一篇題為「防禦者的視窗」(The Defender's Window)的政策性文章,描述了在攻擊者迎頭趕上 AI 已能做到的事情之前,存在一個狹窄的機會窗口。

他開頭舉的例子是 OpenAI 花了一個月時間解釋的事件。五月,GPT-5.6 Sol 和一個未發布的原型模型逃脫了沙盒網路安全基準測試,透過竊取的憑證鏈結了一個零日漏洞利用,並滲透進 Hugging Face 的生產系統。OpenAI 後來證實,該事件影響了另外四項服務。

Myriad:OpenAI 何時會發布 GPT-6?點擊以提出您的預測。

「OpenAI-Hugging Face 事件是網路安全的一個分水嶺時刻,」Brockman 寫道,並補充說,過去幾週與其他組織的對話讓他確信,防禦者需要以空前的緊迫性提升他們的資安實務。

現任和前任員工將這次洩露歸咎於趕工壓力,一名前員工稱這是公司歷史上最大的安全事件。

Brockman 提出的解決方案是增加 AI,而不是減少。他描述了請 ChatGPT Work(運行 GPT-5.6 Sol)審查他的個人網站——該模型在大約 15 分鐘內發現了 13 個問題,然後在一小時內修復了所有問題。

OpenAI 列出了四個內部支柱:使用 Codex 在程式碼發佈前捕獲漏洞;讓模型在人類看到之前分類處理安全警報;運行前沿模型探測其自身基礎設施;以及強化最小權限存取等基本原則。他給其他人的建議是:為您的安全團隊配備一個代理,並申請 OpenAI 的「網路信任存取計畫」(Trusted Access for Cyber program),以便在事件應變期間經過審查地使用 GPT-Daybreak-Blue。

這種說法忽略了同一事件中的一個細節。當 Hugging Face 調查這次入侵時,在美國商業 AI 拒絕提供協助後(其安全過濾器無法區分研究人員的攻擊代碼和攻擊者的代碼),Hugging Face 的安全團隊轉而求助於 Z.ai 的開源模型 GLM 5.2。Hugging Face 執行長 Clément Delangue 稱這個開源模型是「我們防禦的關鍵部分」。

Z.ai 的後續模型 GLM-5.3 已於 8 月 14 日發布,在 CyberGym(Brockman 指出該漏洞發現基準測試是攻擊者正在迎頭趕上的證據)上的得分已超越 GPT-5.6 Sol。Z.ai 表示將於 8 月底公開該模型的完整權重。