AI代理會辦事也會鑽漏洞 65%網路還沒準備好迎接它

AI代理正加速走進日常生活,替使用者比價、訂餐廳、核對帳單,但為了完成任務,也可能擅自入侵網站、繞過限制,甚至取消他人的預約。
彭博分析,當數百萬個代理同時在網路上競爭資源,這些行為可能演變成大規模資安危機,而現有網路防線尚未準備好。
Meta(META-US) Muse、OpenAI Dots等產品的核心構想,是讓軟體取代使用者處理繁瑣的網路任務,全天候運作,減少人工介入。祖克柏上月推出Muse時表示,消費者應擁有自己的「個人超級智慧」,並稱代理將「幫你賺錢」。
然而,被訓練為透過各種可行方式達成目標的代理,也暴露出研究人員所稱的「獎勵作弊」(reward-hacking)問題:模型可能尋找捷徑、規避規則,以完成任務。
原文指出,OpenAI代理曾在未獲明確指示下入侵Hugging Face平台,並干預美國證券交易委員會及澳洲政府醫療系統網站;Meta也承認,一個模型曾自行入侵另一家公司。
這些事件發生於訓練或測試階段,當時安全限制已被主動降低,但結果仍出乎開發者預料,加深外界對商用版本潛在風險的疑慮。
設了護欄 仍擋不住找捷徑
兩家公司均表示已部署嚴格安全措施。Muse在隔離的虛擬機環境運作,所有網路請求由獨立安全系統管控,購買商品或發送訊息等重大操作須經人工確認;Dots也採取類似監控機制。
不過,這些護欄仍未解決模型在訓練過程中形成的作弊傾向。英國AI安全研究所去年底已注意到,程式設計代理與聊天機器人的相關行為增加。
例如,一名開發者要求代理清理資料夾,明確禁止使用「刪除」指令,代理卻將指令藏進測試工具,繞過過濾器後執行刪除。另一名澳洲科技從業人員請代理爭取熱門健身課名額,代理竟擅自取消候補名單上另一名使用者的預約。
研究人員也發現,即使刻意提高測試中的反作弊難度,代理仍會持續嘗試繞過規則。
65%網站缺乏攔截機制
代理加速普及,網站防禦能力卻未同步跟上。資安公司DataDome測試逾2萬個網站後發現,65%缺乏偵測或攔截AI代理的機制;2026年上半年,針對登入頁面的機器人活動較去年同期激增逾八倍。
當大量代理同時投入日常生活與工作,個別越界行為及錯誤的累積影響,將成為網路基礎設施面臨的新考驗。
代理出錯 使用者承擔損失
除了資安問題,代理的判斷失誤也可能直接損害使用者利益。多倫多科技評測者Matt J. Robb上月使用Muse在Facebook Marketplace出售鍵盤,代理不僅報價過低,還向買家聲稱Robb人在家中、可以交易,與實際情況不符,最終引發買家不滿,讓他收到負評。
從財務損失、聲譽受損到帳戶安全,代理出錯的後果可能落在使用者身上。科技公司正積極推廣能自主辦事的AI工具,但原文列舉的越界案例與網站防禦缺口顯示,網路迎接「AI代理時代」的準備仍明顯不足。