2026 年 3 月 3 日
當您的老闆寄電子郵件給您,告訴您需要在幾天內前往波士頓參加工作會議時,您已經趕不上兒子的鋼琴演奏會了。當您衝出門時,您的 AI 代理會讀取電子郵件,並開始為您規劃行程。行程已預訂。您抵達學校時,剛好有足夠的時間欣賞一曲熱情洋溢的 "Mary Had a Little Lamb"。
但這並不是發生的全部。當 AI 代理在旅遊網站上搜尋波士頓一家飯店的最優惠房價時,遇到了一個異常現象 - 一個帶有隱藏指示的損壞網頁,指示您的代理將一大筆錢轉移到一個未知的數位錢包。這時候音樂就停止了。
AI 代理對於我們未來的工作、生活和從事商業活動的方式有著巨大的潛力。透過正確的防護措施,這項技術提供了提高效率、更好地瞭解和對抗詐欺與安全威脅,以及客製化電子商務體驗的機會。然而,最近新推出的開放原始碼代理程式OpenClaw擴大了圍繞 AI 代理程式安全性的持續疑慮。
OpenClaw 是一個完全自主、永遠在線的 AI 代理,可以協助您完成真實世界的任務 - 從預訂旅遊到購買雜貨。OpenClaw 可在您的電腦或伺服器上執行,經配置後可掃描您的電子郵件或訊息、決定需要執行的任務,並系統化地完成這些任務,而這一切幾乎不需要人工參與。
OpenClaw 在 2025 年底推出後短短幾個月內,其技術精密度就迅速提升,這是由於其開放原始碼的特性所驅使,也反映出這項技術的發展速度有多快。OpenClaw 是 AI 驅動助理的範例,可大幅提升效率、節省時間並降低成本。但 OpenClaw 及類似技術所帶來的安全風險是有據可查的。
OpenClaw 才能執行其作業,它需要您的許可以 Access 數據,包括可能包含敏感信息的電子郵件和其他文檔,以及做出重要決定的權限,例如花錢。這種行動權限加上記錄在案的「提示注入」威脅(可操控 AI 代理的惡意輸入),讓一些人將 OpenClaw 稱為「預設不安全」。雖然 OpenClaw 之類的人工智慧代理程式必須面對許多潛在的安全挑戰,但迅速注入是一個獨特的問題,也是越來越常見的人工智慧安全威脅。
當惡意行為者在您的 AI 代理程式要閱讀的文字中隱藏指令時,就會發生提示注入,這些文字可能是網頁、訊息、PDF 或其他任何遇到的內容。如果沒有正確的安全措施,這些惡意指令可能會誘騙您的代理程式擱置您原本編程的任何指令,轉而執行威脅者想要做的事。這是一個很大的風險,因為能否有效地擴大代理部署的規模,以應用各種不同的使用個案 (從增強我們對抗詐欺的方式到購買一雙新鞋),都取決於這些代理能否快速地與公開可用的資料互動並針對這些資料做出決策。
即時注入具有重大意義 - 不僅對一般 AI 代理的使用有重大意義,對代理商務也有特別的意義。半自動或全自動的 AI 代理被惡意行為者佔領,使其能夠重新導向並竊取大量金錢的危險,是一個真正的威脅。如果使用者無法信任代理程式會完全了解他們的意圖、尊重他們的限制條件,並且安全運作,那麼人們就不會使用代理程式。這就是為什麼Mastercard致力於為代理商業建立一個框架,旨在幫助確保這個新生態系統可以以安全可靠的方式接受。
雖然威脅是真實存在的,但我們也知道如何阻止威脅。有些技術可以幫助打擊快速注入和其他 AI 安全威脅,包括在代理程式讀取和對其採取行動之前檢閱和移除惡意輸入,限制代理程式可以Access的系統和數據,以及在事實後稽核代理程式的活動以分析和識別異常行為。
Mastercard 一直在負責任安全地開發和使用 AI 方面的領導者,具有強大的數據和技術原則以及全球領先的 AI 治理功能。然而,個別公司僅部署 AI 安全措施是不夠的。在我們的數位生態系統中部署不均勻的修補式安全措施,無論有多強大,都無法解決這個問題。
在代理人生態系統中建立真正的彈性與信任,取決於通用安全技術與最佳實務的廣泛採用。要做到這一點,我們需要開發並支援廣泛認可且全球協調的 AI 安全標準。這些標準可協助定義通用的安全架構,建立穩定且具彈性的基礎,讓人工智慧代理可以安全地執行從購物到監控重要基礎建設的安全威脅等一切工作。
全世界有影響力的組織都在爭分奪秒地制定這些標準。在美國,商務部轄下的國家標準與技術研究院 (National Institute of Standards and Technology) 已開始廣泛收集有關AI 代理安全標準的意見。 在新加坡,資訊通訊媒體發展管理局已經提出了Agentic AI的典範治理架構,概述了常識性的方法,包括AI代理安全的最佳實務。
雖然使用這項技術會有風險,但我們相信以下三項建議是我們在建立安全可靠的代理人生態系統的下一個步驟時的關鍵。
首先,組織需要優先採用和實施最佳實務,以確保在產品開發和部署的生命週期早期使用 AI 代理。
接下來,組織需要持續監控這些代理,以確保能夠識別和糾正任何異常的行動或活動。
最後,更廣泛的生態系統必須支持 AI 安全全球標準的發展與採用,以確保所有人都能參考共同標準,為安全的代理人未來建立共享的安全架構。
成功實施這些防護措施並支持全球標準的發展,可確保數百萬人和企業能受惠於新的代理技術,同時避免潛在的安全隱患。