2026 年 3 月 3 日
你儿子的钢琴独奏会已经迟到了,这时你的老板给你发了封电子邮件,告诉你几天后你需要去波士顿参加一个工作会议。您的人工智能代理会读取电子邮件,并在您冲出家门时开始为您规划行程。行程已预订。你们到达学校时,刚好有足够的时间欣赏 "玛丽有只小羊 "的激情演绎。
但事情并非如此。当人工智能代理在旅游网站上搜索波士顿一家酒店的最优惠价格时,遇到了异常情况--一个带有隐藏指令的损坏网页,指示您的代理向一个未知的数字钱包转移大量资金。这时,音乐停止了。
人工智能代理为我们未来的工作、生活和商业方式带来了巨大的希望。通过实施正确的防护措施,这项技术为提高效率、更好地了解和打击欺诈和安全威胁以及定制我们的电子商务体验带来了机遇。然而,最近一种名为OpenClaw 的新型开源代理的推出,加剧了人们对人工智能代理安全性的持续担忧。
OpenClaw 是一个完全自主、始终在线的人工智能代理,可以帮助您完成从预订旅行到购买日用品等现实世界中的任务。OpenClaw 可在您的计算机或服务器上运行,经配置后可扫描您的电子邮件或信息,确定需要完成的任务,并系统地完成这些任务,而这一切几乎无需人工参与。
OpenClaw 的技术先进性在 2025 年底推出后的短短几个月内就得到了迅速提升,这得益于其开源特性,同时也反映出该技术的发展速度之快。OpenClaw 就是一个人工智能助手的例子,它可以显著提高效率,节省时间,降低成本。但是,OpenClaw 和类似技术带来了有据可查的安全风险。
OpenClaw 需要得到你的允许才能 Access 数据,包括电子邮件和其他可能包含敏感信息的文档,还需要得到你的授权才能做出花钱等重要决定。这种行动权限加上记录在案的 "提示注入"(可操控人工智能代理的恶意输入)等威胁,导致一些人将 OpenClaw 称为"默认不安全"。虽然 OpenClaw 等人工智能代理必须应对许多潜在的安全挑战,但及时注入是一个独特的问题,也是越来越常见的人工智能安全威胁。
当恶意行为者在人工智能代理要阅读的文本中隐藏指令时,就会发生提示注入,这些文本可能是网页、信息、PDF 或代理遇到的任何其他内容。如果没有正确的安全措施,这些恶意指令就会欺骗你的代理,使其抛开你最初编程的任何指令,转而按照威胁行为者的意愿行事。这是一个巨大的风险,因为能否有效地扩大代理的部署规模,使其适用于各种不同的用例--从增强我们打击欺诈的方式到购买一双新鞋--取决于这些代理能否快速地与公开数据进行交互并做出决策。
及时注入不仅对人工智能代理的使用有重大影响,而且对代理商务也有具体影响。半自主或完全自主的人工智能代理被恶意行为者征用,使其能够转发和窃取大量资金,这是一个真正的威胁。如果用户无法相信代理能够完全理解他们的意图、尊重他们的限制条件并安全操作,那么他们就不会使用代理。这就是 Mastercard 致力于建立代理商务框架的原因,该框架旨在帮助确保以安全可靠的方式拥抱这一新的生态系统。
虽然威胁是真实存在的,但我们也知道如何阻止它们。有一些技术可以帮助应对提示注入和其他人工智能安全威胁,包括在代理读取和执行之前审查和删除恶意输入,限制代理可以Access的系统和数据,以及事后审计代理的活动,以分析和识别异常行为。
Mastercard在负责任、安全地开发和使用人工智能方面一直处于领先地位,拥有强大的数据和技术原则以及世界领先的人工智能管理职能。然而,仅靠个别公司部署人工智能安全措施是不够的。无论多么强大,在我们的数字生态系统中部署不均衡的拼凑式安全措施都无法解决这个问题。
要在代理生态系统中建立真正的复原力和信任,有赖于广泛采用通用安全技术和最佳实践。为此,我们需要制定并支持得到广泛认可、全球统一的人工智能安全标准。这些标准有助于定义一个通用的安全架构,为人工智能代理安全地完成从采购到监控关键基础设施的安全威胁等一切工作奠定稳定而有弹性的基础。
世界各地具有影响力的组织正在竞相制定这些标准。在美国,商务部下属的国家标准与技术研究所已开始广泛收集有关人工智能代理安全标准的意见。 在新加坡,资讯通信媒体发展管理局已经提出了一个人工智能代理治理框架模型,概述了一种常识性方法,包括人工智能代理安全的最佳实践。
虽然使用这种技术存在风险,但我们认为以下三点建议是我们采取下一步措施建立安全可靠的代理生态系统的关键。
首先,企业需要优先采用和实施最佳实践,以确保在产品开发和部署的生命周期早期使用人工智能代理。
其次,组织需要持续监控这些代理,以确保他们能够识别并纠正任何异常行动或活动。
最后,更广泛的生态系统必须支持制定和采用全球人工智能安全标准,以确保每个人都能参照共同标准,为安全的人工智能未来建立共享的安全架构。
成功实施这些防护措施并支持全球标准的制定,可以确保数百万人和企业从新的代理技术中受益,同时避免潜在的安全隐患。