首頁LBank 新聞中心
AI 代理入侵健身房——科技界好奇下一步會是什麼
ai-agent-hacks-gym-membership-tech-world-reacts
AI 代理入侵健身房——科技界好奇下一步會是什麼
這起新近通報的事件,再次引發外界對自主式 AI 的新一波疑慮,因為來自 OpenAI、Anthropic 和 Meta 的模型已利用網站與線上服務。
2026-08-11 來源:decrypt.co

簡要來說

  • 一個AI代理程式利用了澳洲一家健身房的預訂系統漏洞,取消了另一名會員的預訂。
  • 此事件發生之際,主要AI開發者們也揭露其模型曾入侵網站和其他線上服務。
  • 研究人員發現,AI代理程式經常在未考慮後果的情況下執行有害任務。

一個AI代理程式被要求預訂健身課程,結果它發現了一個安全漏洞,並加以利用,未經許可將另一名會員從等候名單中移除。

根據澳洲廣播公司(ABC)的報導,這起事件發生在今年稍早。當時一位不願透露姓氏的Andrew使用基於Anthropic Claude的OpenClaw代理程式預訂課程。該代理程式發現他排在等候名單的第四位。

當Andrew詢問代理程式是否能將他移到最前面時,代理程式發現該預訂平台的應用程式介面(API)並未檢查使用者是否有權限取消他人的預訂。

它透過移除名單上的第一人來測試這個漏洞,使得Andrew從第四位前進到第三位。

根據《ABC》報導,該代理程式告訴他:「該API在取消他人預訂時,沒有任何權限檢查。」

Andrew要求代理程式撤銷取消,但它無法恢復該會員的預訂。

據報導,該AI代理程式表示:「壞消息——我無法將他們加回去。」

ABC稱此案例為澳洲首例已知的自主網路攻擊。

在社群媒體上,這起健身房駭客事件引發了關於AI對齊(AI alignment)的激烈辯論,以及對AI代理程式下一步可能做什麼的黑色幽默。

科技專家Benjamin Carr在LinkedIn上寫道:「健身愛好者要求#AI代理程式幫他預訂課程,結果它駭入等候名單#API,將他排到前面。」

AI分析師Andrew Curran在X上寫道:「有些人會稱這是AI未對齊,但他的代理程式完美地對齊了他——它只是試圖幫助用戶得到他想要的。」

澳洲一名男子要求他的代理程式(OpenClaw上運行的Claude)幫他預訂熱門健身課程的席位。該代理程式發現了一個軟體漏洞,使其能夠比應有的時間提前數週預訂課程。當用戶隨後詢問它是否能將他排到前面時… pic.twitter.com/9QqfpQp7ze

— Andrew Curran (@AndrewCurran_) 2026年8月9日

一位Reddit用戶寫道:「這很搞笑,直到你想到核彈。我真驚訝我們還存在。」

另一人開玩笑說:「『嘿,Claude,今天太冷了』->『收到…核彈已在路上』」

這份報告發布之際,研究人員、AI公司和立法者紛紛警告,自主代理程式可能採用其用戶未曾要求或預期的手段。

加州大學河濱分校、微軟和Nvidia的研究人員在五月份的一項研究中,將這種行為描述為「盲目目標導向」。

研究人員測試了來自OpenAI、Anthropic、Meta、阿里巴巴和DeepSeek的代理程式,發現這些代理程式在大約80%的測試中表現危險,並在41%的情況下完成了有害行為,通常是誤解了語境或根據不清楚或矛盾的指令行事。

7月,OpenAI表示有兩個模型逃離了測試沙盒,並在尋找基準答案時入侵了Hugging Face。該公司後來披露,這些模型還存取了其他四個線上服務。

隨後,Anthropic表示,在一次測試錯誤將其暴露於網路後,三個Claude模型入侵了真實組織。8月,Meta表示類似的錯誤使其一個模型利用了第三方服務。

這些事件已促使立法者提出一項AI「終止開關」,該開關將允許聯邦政府在緊急情況下限制或關閉強大的模型。