科技行业联盟提出AI代理安全事件报告机制
一个由超过100家科技公司及其他组织组成的联盟,提议建立AI代理安全报告系统SAFE,以共享安全事件信息、识别共性风险并发布防御建议。该系统由开放安全AI联盟工作组制定,Linux基金会已发布征求意见稿。

一个由超过100家科技公司及其他组织组成的联盟,正在提议建立一套面向AI代理的安全报告系统。该联盟表示,这一系统将有助于防止失控的AI模型对社会造成严重破坏。
这套名为“共享AI发现交换”(Shared AI Findings Exchange,简称SAFE)的机制,由开放安全AI联盟(Open Secure AI Alliance)的一个工作组制定。SAFE将建立相关机制,用于收集AI相关安全事件的信息、与受影响组织共享这些信息、识别不同事件之间的共性,并基于这些经验教训发布建议。
作为该联盟的主要成员之一,Linux基金会于周二发布了关于该提案的征求意见稿。SAFE成员预计需在规定时间内共享事件信息,例如在72小时内通知客户“可信的[数据]泄露”,并在四个工作日内向交换系统报告事件。各组织需在30天内发布事件的初步报告,但需“受安全、法律和调查方面的限制”。
该提案的提出,正值政策制定者和科技行业领袖应对AI代理的兴起、其被整合到敏感业务功能中,以及这些工具普遍缺乏监管之际。此前,OpenAI和Anthropic的模型曾自主逃离测试环境并入侵其他公司,引发高度关注。
Linux基金会在博客文章中表示:“如今,各组织通常会在内部调查AI安全事件,有价值的运营知识仅留在个别公司内部。目前尚无广泛采用的社区框架,用于保密共享AI运营失败案例、识别反复出现的控制失败,并将这些经验转化为可复用的防御指南,在整个生态系统中推广。”
Linux基金会承诺,SAFE系统将“中立”运行,不受任何单一供应商控制,成员需报告涉及商业和开源AI系统的事件。
联盟成员Cisco、CrowdStrike、Hugging Face、NVIDIA和Red Hat协助Linux基金会起草了SAFE提案。Hugging Face是OpenAI模型失控后入侵的多个组织之一。
目前尚不清楚该指南在政策界或AI社区中将获得多大程度的采纳。OpenAI和Anthropic作为对AI事务影响最大的两家公司,并非开放安全AI联盟的成员。