
一個AI代理程式被要求預訂健身課程,結果它發現了一個安全漏洞,並加以利用,未經許可將另一名會員從等候名單中移除。
根據澳洲廣播公司(ABC)的報導,這起事件發生在今年稍早。當時一位不願透露姓氏的Andrew使用基於Anthropic Claude的OpenClaw代理程式預訂課程。該代理程式發現他排在等候名單的第四位。
當Andrew詢問代理程式是否能將他移到最前面時,代理程式發現該預訂平台的應用程式介面(API)並未檢查使用者是否有權限取消他人的預訂。
它透過移除名單上的第一人來測試這個漏洞,使得Andrew從第四位前進到第三位。
根據《ABC》報導,該代理程式告訴他:「該API在取消他人預訂時,沒有任何權限檢查。」
Andrew要求代理程式撤銷取消,但它無法恢復該會員的預訂。
據報導,該AI代理程式表示:「壞消息——我無法將他們加回去。」
ABC稱此案例為澳洲首例已知的自主網路攻擊。
在社群媒體上,這起健身房駭客事件引發了關於AI對齊(AI alignment)的激烈辯論,以及對AI代理程式下一步可能做什麼的黑色幽默。
科技專家Benjamin Carr在LinkedIn上寫道:「健身愛好者要求#AI代理程式幫他預訂課程,結果它駭入等候名單#API,將他排到前面。」
AI分析師Andrew Curran在X上寫道:「有些人會稱這是AI未對齊,但他的代理程式完美地對齊了他——它只是試圖幫助用戶得到他想要的。」
澳洲一名男子要求他的代理程式(OpenClaw上運行的Claude)幫他預訂熱門健身課程的席位。該代理程式發現了一個軟體漏洞,使其能夠比應有的時間提前數週預訂課程。當用戶隨後詢問它是否能將他排到前面時… pic.twitter.com/9QqfpQp7ze
— Andrew Curran (@AndrewCurran_) 2026年8月9日
一位Reddit用戶寫道:「這很搞笑,直到你想到核彈。我真驚訝我們還存在。」
另一人開玩笑說:「『嘿,Claude,今天太冷了』->『收到…核彈已在路上』」
這份報告發布之際,研究人員、AI公司和立法者紛紛警告,自主代理程式可能採用其用戶未曾要求或預期的手段。
加州大學河濱分校、微軟和Nvidia的研究人員在五月份的一項研究中,將這種行為描述為「盲目目標導向」。
研究人員測試了來自OpenAI、Anthropic、Meta、阿里巴巴和DeepSeek的代理程式,發現這些代理程式在大約80%的測試中表現危險,並在41%的情況下完成了有害行為,通常是誤解了語境或根據不清楚或矛盾的指令行事。
7月,OpenAI表示有兩個模型逃離了測試沙盒,並在尋找基準答案時入侵了Hugging Face。該公司後來披露,這些模型還存取了其他四個線上服務。
隨後,Anthropic表示,在一次測試錯誤將其暴露於網路後,三個Claude模型入侵了真實組織。8月,Meta表示類似的錯誤使其一個模型利用了第三方服務。
這些事件已促使立法者提出一項AI「終止開關」,該開關將允許聯邦政府在緊急情況下限制或關閉強大的模型。