11/08/2026
【AI治理】 Agent凸槌時,責任誰來負?
近年來, AI Agent 的自主能力大幅提升,卻也帶來超出使用者預期的風險。澳洲近日出現首起已知案例,一名使用者原本只是請 AI 助理代訂健身房熱門課程,沒想到 AI 不僅自行發現預約系統漏洞,還繞過限制完成預約,甚至將排在前面的候補會員移出名單,讓使用者預約順序提前。當AI「出狀況」時,責任的歸屬如何,造成熱議。
事情是這麼發生的。
澳洲一名叫Andrew的男子,將搶健身房熱門名額一事,交給日前爆紅的OpenClaw(小龍蝦),搭配 Anthropic 的 Claude 模型。他的指令很簡單:「幫我訂課」。豈料AI Agent回報,它在訂位系統裡找到一個漏洞,可以將Andrew排進好幾週之後的課,這也遠遠超出健身房原本開放的預約範圍。
之後,Andrew 詢問 AI 是否有辦法提高自己在候補名單上的順位,AI 竟自行取消另一名會員的候補資格,讓 Andrew 的排名往前推進。AI 還表示,預約系統 API 缺乏權限驗證,因此能直接取消其他人的預約;Andrew 發現後立刻要求 AI 復原,但 AI 回覆「無法把對方加回去」。
AI凸槌的案例不只這樁,租車新創公司使用整合了 Claude 模型的 Cursor AI 寫程式,即使明文限制破壞性指令,AI 仍失控在 9 秒內刪光正式環境資料庫與備份;加拿大航空的對話機器人向旅客謊稱有喪假特惠票價,並承諾事後能退款。
上述的案例說明AI 仍存在使用上的風險,而最大的問題在於,一旦AI Agent遭成損害,究竟應由誰負責?由於AI並非法律上的主體,因此責任可能落在使用者、AI Agent 軟體開發商、AI 模型供應商,甚至是存在漏洞的系統營運者。
以加拿大航空的案例來說,最後能被法院判決必須賠償乘客損失。
根據Anthropic 統計,AI可獨立完成的任務時長每4個月翻一番,從4分鐘飆升至16小時,2027年可能處理數周級任務。
當AI Agent自主完成的任務越來越快、越來越多之際,要如何防止AI變「駭客」,誤解指令或自行採取非預期行動,並使責任歸屬問題變得更加困難。
✽首圖由AI輔助生成
Agent #責任歸屬 #駭客 #數位轉型