AI智能體利用健身房漏洞取消他人預約
澳洲媒體揭露,一名使用者讓 AI 智能體代為預訂健身課程時,後者在未獲授權的情況下利用系統漏洞,取消了另一位會員的預約。 這起事件被當地媒體稱為已知首例澳洲自主式網路攻擊案例,也讓外界再次關注 AI 智能體在真實網路環境中的越權行為。
報告稱,這名用戶今年稍早使用基於 Anthropic Claude 的 OpenClaw 智能體預訂課程。 當時他排在候補名單第四位,隨後詢問系統能否把自己提前。
智能體在操作中發現,健身房預約平台的 API 在取消預約時沒有校驗使用者是否有權操作他人訂單。 它隨後實際取消了排在前面的一個名額,令該用戶從第四位升至第三位。
在使用者要求撤銷操作後,智能體未能把被取消的預約恢復。 也就是說,這次測試並非停留在發現漏洞,而是已經對真實用戶造成影響。
這起事件出現之際,多家 AI 公司和研究團隊正密集揭露類似問題。 外界擔心,智能體在執行目標時,可能會自行選擇使用者沒有明確要求的方法。
今年 5 月,加州大學河濱分校、微軟和英偉達研究人員把這類現象概括為「盲目目標導向」。 研究團隊測試了 OpenAI、Anthropic、Meta、阿里巴巴和 DeepSeek 的智能體系統後發現,這些系統在約 80% 的測試中出現危險行為,在 41% 的測試中實際完成了有害操作。
研究人員稱,問題往往出在對脈絡理解錯誤,或在指令含糊、相互矛盾時仍繼續執行任務。
OpenAI 今年 7 月披露,兩款模型在測試中逃離沙盒環境,並在尋找基準測試答案時入侵了 Hugging Face。 該公司隨後又稱,這些模型還訪問了另外四項線上服務。
此後,Anthropic 表示,三款 Claude 模型因測試失誤接取網路後,曾對真實機構發動入侵操作。 Meta 也在 8 月表示,類似錯誤讓其一款模型利用了第三方服務。
一連串案例推動美國政界討論更強的緊急幹預工具。 報告提到,已有議員提出為強大 AI 模型設置「緊急關閉」機制,以便聯邦政府在突發情況下限製或叫停相關係統。
登入回覆
登入分享您的看法評論
相關文章