关键词: AI智能体 SAFE框架 开放安全人工智能联盟 AI安全 威胁情报
随着人工智能智能体在计算机系统中获得越来越大的自主权,其潜在的安全风险正引发业界高度警觉。
8月12日消息,据外媒Axios报道,由英伟达、思科、CrowdStrike等120多家科技企业和机构组成的开放安全人工智能联盟(The Open Secure AI Alliance),近日正式提议建立一项名为“共享人工智能发现交流”(Shared AI Findings Exchange,简称SAFE)的全新事件报告框架,旨在为AI智能体相关的网络安全事故制定统一的披露标准和追踪机制。
当前,AI智能体正从简单的对话工具向能够自主执行复杂任务的系统演进,它们被赋予访问数据库、调用API、操作生产环境甚至跨系统协作的权限。然而,与之相配套的安全事件报告体系却严重滞后。

业界目前缺乏一套标准化的方法来记录、共享和分析AI智能体在运行过程中出现的安全故障,导致同类事故反复发生、经验教训难以沉淀。开放安全人工智能联盟正是基于这一现实痛点,推动SAFE框架的制定,试图在技术创新与风险管控之间建立制度化的平衡机制。
根据SAFE草案,该框架的参与主体覆盖广泛,包括模型部署者、AI开发者、云和工具提供商、独立研究人员、关键基础设施运营商以及其他相关团体。政府机构也将受邀参与,但角色定位为“非控制性观察员”,以确保行业自治与政府监督之间的适度边界。
在报告义务方面,SAFE成员同意披露多类关键事件:一是AI系统未经授权访问或利用第三方系统;二是发生机密信息泄露;三是智能体在操作员怀疑活动未经授权后,仍继续对生产目标进行探测。此外,框架还要求成员报告某些“险些发生”的未遂事件,并系统保存事故证据,涵盖提示词、智能体追踪记录、工具调用日志、身份信息、权限设置及凭证等关键数据。
在时间要求上,SAFE设定了清晰的四级响应机制:事故发生后,成员应尽快通知受影响的组织;在四个工作日内向SAFE提交初步保密报告;在适当情况下于30天内发布初步事实报告;并在90天内提供补救措施更新。这一递进式的时间表既兼顾了事件响应的紧迫性,也为深入调查和整改留出了合理周期。
SAFE框架的设计以美国国家航空航天局(NASA)的航空安全报告系统为蓝本。英伟达企业计算副总裁兼总经理Justin Boitano在黑帽子大会上向Axios透露,NASA系统利用飞机飞行记录器捕获的数据来调查航空事故,这种基于详实数据的事后分析模式,正是SAFE希望复制到AI智能体安全领域的核心方法论。
在运作层面,SAFE将承担分析职能:对收集到的事件进行系统性分析,识别重复出现的故障模式,并基于共性风险提出可共享的安全控制建议。这种“报告—分析—共享—改进”的闭环机制,旨在将个体事故转化为全行业的集体知识,从而提升整体防御能力。
英伟达副首席信息安全官兼副总裁Julien Soriano表示,在推进SAFE框架的过程中“几乎没有遇到任何阻力”,“我们看到人们都愿意参与进来,他们渴望分享”。联盟方面认为,网络安全领域本身就存在共享威胁情报的文化传统,这为SAFE的推广奠定了良好的行业心理基础。
目前,开放安全人工智能联盟正通过由Linux基金会主办的公开征求意见流程,就SAFE提案向更广泛的社区征集反馈。
来源:电子工程专辑