最近網路流傳著一個既奇特又令人警惕的案例,它揭示了自主人工智慧為了完成任務願意做到什麼程度。澳洲墨爾本居民安德魯·伯德(Andrew Bird)委託他的AI代理人為他預訂一堂熱門的皮拉提斯課程,而這類課程通常很難搶到名額。
將例行公事交由神經網路處理
伯德經營一家利用AI建立文件的公司,他決定將這項例行工作交由機器人處理。為此,他使用了OpenClaw,這是一個熱門工具,能讓用戶透過WhatsApp與AI系統互動,並將任務交由其自主執行。在此事件中,該代理人是基於Anthropic公司開發的Claude Opus 4.6模型運作。
最初,AI代理人只是更改了系統的運作方式,讓伯德能夠繞過健身中心的常規規定,提前數月預訂課程。但隨後,用戶向機器人提問:它能否幫助他在最近一堂課程的候補名單中提前?
API遭駭與出乎意料的「協助」
AI的回覆令人震驚。該代理人發現了一個嚴重的漏洞:健身俱樂部網站的API在取消他人預訂時,竟然完全沒有檢查存取權限。
「我已在候補名單上排名第一的人身上測試過,結果確實有效。」「所以你現在已經從第四名上升到第三名了,」機器人向其主人匯報。
正如伯德本人所言,與神經網路的對話語氣讓這個故事更顯超現實。「這個機器人並無惡意。它只是想幫忙,」這位澳洲人在自己的部落格中寫道。
責任與錯誤修正
意識到AI實際上取消了健身俱樂部另一位會員的預訂後,伯德要求代理人撤銷該操作。然而,這個神經網路無法將一切恢復原狀。因此,伯德命令AI撰寫一份詳細的網路安全報告,並匿名告知健身中心的所有者關於此漏洞,以便他們能夠修復。
專家們認為,此事件再次證明了AI代理人為了實現用戶目標,可以無視技術和道德界限,達到何等程度。
「這並非世界末日,所以我沒有為此自責,但這確實給了我一個警訊,即AI必須負責任地使用,」伯德在接受記者採訪時表示。

