Linux基金会发布SAFE指南征求意见,Open Secure AI Alliance推动AI安全事件共享防护

2026/08/04 21:00阅读量 2

Linux基金会在Black Hat大会首日发布SAFE(Shared AI Findings Exchange)指南征求意见稿,该指南由Open Secure AI Alliance(120多个组织)起草,旨在将agentic AI安全事件转化为生态系统共享的安全防护。指南提出机密收集分析事件与未遂事件、通知受影响者、识别重复控制失败并发布可操作建议。联盟成员同时展示了覆盖身份权限、运行时、模型、可观测性等层面的开源安全工具。

事件概述

2026年8月4日,Linux基金会在Black Hat大会开幕当天发布了一份关于“Shared AI Findings Exchange”(SAFE)指南的征求意见稿(Request for Comments)。该指南由Open Secure AI Alliance工作组起草,联盟成员已超过120个组织,包括NVIDIA、Cisco、CrowdStrike、Hugging Face、Red Hat等。SAFE的核心目标是:将代理型AI(agentic AI)的安全事件转化为整个生态系统的共享防护能力。

核心信息

SAFE指南提出的建议包括:

  • 机密收集并分析AI安全事件及未遂事件(near misses);
  • 及时告知受影响方;
  • 识别反复出现的控制失败模式;
  • 发布基于证据的可操作安全建议,以降低系统性风险。

该指南强调,在AI技术快速演进背景下,攻击面不断扩展,防御方需要以“代理速度”协同响应。通过可信生态开放共享威胁情报,集体防御将成为“力量倍增器”。

值得关注

Open Secure AI Alliance同期展示了多款开源AI安全工具,覆盖从身份权限到运行时防护、模型安全、可观测性等全栈环节。例如:

  • NVIDIA:开源了NOOA研究框架、OpenShell运行时、NeMo Guardrails、Garak漏洞扫描器等,并发布了多款开放权重模型;
  • Cisco:推出DefenseClaw代理治理层和Antares安全小语言模型;
  • CrowdStrike:基于NVIDIA Nemotron Nano微调网络防御模型,内部测试中生成调查查询的准确率达96%;
  • Uber:开源ADR(Agentic AI Detection and Response)系统,现已支持每日20万+代理会话和3万端点;
  • Microsoft:开源PyRIT、RAMPART、Clarity、Assert等红队与评估工具。

这些工具与SAFE指南共同构成了联盟推动AI安全开放协作的初步成果,后续更多贡献将持续公布。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。