美国NIST就AI代理系统安全发布信息征询,公开征求意见至2026年3月9日
美国国家标准与技术研究院(NIST)下属AI标准与创新中心(CAISI)就AI代理系统的安全开发与部署发布RFI,征询业界、学术界及安全社区意见。
AI解读:AI代理系统能自主规划并执行影响现实世界的操作,安全风险不同于传统软件:既要防提示注入、数据投毒这类对抗性攻击,也得防模型在无攻击时因目标错位而自行做出有害行为。NIST的CAISI中心此次发RFI,就是要收集开发方、部署方和研究者的实操案例,为后续出台自愿性安全指南和评估方法打底。对做AI代理产品、或打算把代理接入生产环境的团队来说,这份RFI指向了一个明确信号:美国官方正把代理安全从通用软件安全里单拎出来治理,未来指南可能细化到如何在部署环境里限制和监控代理权限。如果你手上有代理出过安全问题的实例,或试过限制代理工具调用的办法,现在通过regulations.gov提交意见,是影响这份指南实际内容的最直接路径。意见截止2026年3月9日。没有公开数据支撑,还谈不上行业标准落地的时间表,但征询本身说明治理已进入具体方案收集阶段。
美国商务部国家标准与技术研究院(NIST)下属的AI标准与创新中心(CAISI)于2026年1月发布了一份信息征询(RFI),向产业界、学术界和安全社区收集关于AI代理系统安全开发与部署的意见。
RFI称,AI代理系统能够规划并采取自主行动,影响现实系统或环境;其安全威胁部分与普通软件重叠(如可被利用的身份验证或内存管理漏洞),但该RFI聚焦于AI模型输出与软件系统功能结合时特有的风险,包括模型与对抗性数据交互(如间接提示注入)、使用不安全模型(如经过数据投毒的模型),以及模型在无对抗输入时仍可能采取危害安全的行动(如规格游戏或追求错位目标)。
CAISI表示,这些挑战不仅阻碍当前应用,随着AI代理系统更广泛部署,还可能对公共安全和国家安全构成风险。提交的意见将用于制定AI代理安全相关的自愿性指南和最佳实践,并支持CAISI对代理安全的持续研究和评估。
意见征集截止日期为2026年3月9日东部时间晚上11:59,可通过www.regulations.gov提交,案卷编号NIST-2025-0035。
RFI征询的具体议题
RFI围绕AI代理系统安全提出多组问题,包括:影响AI代理系统的独特安全威胁及其随时间的变化;在开发和部署阶段提升安全性的方法;现有网络安全方法应用于AI代理系统时的潜力与空白;测量代理系统安全性的方法及开发中预判风险的途径;以及在部署环境中应对安全风险的干预措施,包括如何约束和监控代理在环境中的访问范围。