
NVIDIA 于 2026 年 7 月 27 日宣布成立 Open Secure AI Alliance,与云、网络安全、企业软件、开源基金会和 AI 研究团队一起建立并分享开放的 AI 安全工具。NVIDIA 列出的首批参与者包括 Microsoft、Cisco、CrowdStrike、Hugging Face、IBM、LangChain、Linux Foundation、Salesforce、ServiceNow、SpaceXAI 等。这是联盟成立公告,不是单一模型发布。
联盟的核心主张是,AI 防御能力不应只存在于少数不可检查的封闭系统。NVIDIA 认为,开放模型和开放 harness 可以让防御者检查、调整并在自己的基础设施上运行安全工具,同时减少对单一供应商的依赖。这是 NVIDIA 及参与者的政策和工程方向,并不意味着开放模型天然更安全。
公告把安全范围从 model weights 推向完整的 agent stack,包括 identity、permissions、harnesses、guardrails、logs 和 evaluation。联盟列出的方向包括身份与隔离、安全模型格式、多模型扫描、漏洞修复、secure coding workflow,以及漏洞公开披露。这个范围更接近实际部署要求,因为 agent 失控不一定源于模型本身。
NVIDIA 同时公布开源的 NVIDIA Labs Object-Oriented Agent(NOOA)研究框架,声称可以帮助 agent harness 让行为更容易测试、追踪、审计和治理。其他参与者也提出各自的建设,例如 HPE 的 SPIFFE/SPIRE 身份框架、Hugging Face 捐出 Safetensors、IBM 和 Red Hat 的 Lightwell,以及 Microsoft 的 MDASH 多模型 agent 扫描 harness。这些项目各自有不同成熟度和使用条件,不能只按联盟名单视为安全认证。
公告引用 Hugging Face 一宗安全事件作为例子,并称团队使用自有基础设施上的 GLM 5.2 分析超过 17,000 个 actions 以协助控制入侵。这是 NVIDIA 公告中的供应商叙述,文章没有把它当成独立验证的成效数据。类似案例在采用前仍需核对事件报告、模型版本、输入数据、人工介入和实际错误率。
对企业来说,联盟最实用的信号不是「开放」两个字,而是把 agent 安全拆成可检查的控制面:谁可以代表 agent 登录、哪些工具可以被调用、工作是否在隔离环境执行、每次操作是否留有 log,以及发现问题后能否停用、修补和回溯。这些控制要配合自己的数据敏感度和 workflow 做测试。
Open Secure AI Alliance 反映 AI 安全竞争正在从单一 model guardrail 转向更完整的 operational stack。开放工具可以扩大防御者的检查和修补能力,但治理、权限、评估和事故响应仍然需要清晰的责任人和可验证的流程。



