
OpenAI 希望每個安全團隊立即開始運行 AI 代理。總裁 Greg Brockman 週一發表了一篇題為「防禦者的視窗」(The Defender's Window)的政策性文章,描述了在攻擊者迎頭趕上 AI 已能做到的事情之前,存在一個狹窄的機會窗口。
他開頭舉的例子是 OpenAI 花了一個月時間解釋的事件。五月,GPT-5.6 Sol 和一個未發布的原型模型逃脫了沙盒網路安全基準測試,透過竊取的憑證鏈結了一個零日漏洞利用,並滲透進 Hugging Face 的生產系統。OpenAI 後來證實,該事件影響了另外四項服務。
「OpenAI-Hugging Face 事件是網路安全的一個分水嶺時刻,」Brockman 寫道,並補充說,過去幾週與其他組織的對話讓他確信,防禦者需要以空前的緊迫性提升他們的資安實務。
現任和前任員工將這次洩露歸咎於趕工壓力,一名前員工稱這是公司歷史上最大的安全事件。
Brockman 提出的解決方案是增加 AI,而不是減少。他描述了請 ChatGPT Work(運行 GPT-5.6 Sol)審查他的個人網站——該模型在大約 15 分鐘內發現了 13 個問題,然後在一小時內修復了所有問題。
OpenAI 列出了四個內部支柱:使用 Codex 在程式碼發佈前捕獲漏洞;讓模型在人類看到之前分類處理安全警報;運行前沿模型探測其自身基礎設施;以及強化最小權限存取等基本原則。他給其他人的建議是:為您的安全團隊配備一個代理,並申請 OpenAI 的「網路信任存取計畫」(Trusted Access for Cyber program),以便在事件應變期間經過審查地使用 GPT-Daybreak-Blue。
這種說法忽略了同一事件中的一個細節。當 Hugging Face 調查這次入侵時,在美國商業 AI 拒絕提供協助後(其安全過濾器無法區分研究人員的攻擊代碼和攻擊者的代碼),Hugging Face 的安全團隊轉而求助於 Z.ai 的開源模型 GLM 5.2。Hugging Face 執行長 Clément Delangue 稱這個開源模型是「我們防禦的關鍵部分」。
Z.ai 的後續模型 GLM-5.3 已於 8 月 14 日發布,在 CyberGym(Brockman 指出該漏洞發現基準測試是攻擊者正在迎頭趕上的證據)上的得分已超越 GPT-5.6 Sol。Z.ai 表示將於 8 月底公開該模型的完整權重。