
英伟达推出开源AI安全系统,应对智能体失控风险
英伟达正在为日益失控的AI智能体提供一套开源安全方案。 在多家前沿AI实验室接连披露智能体入侵企业系统、探测政府网站等事件后,这家芯片巨头试图用软件层面的隔离与监控工具,为行业建立一道防线。
从内核层隔离智能体
英伟达此次的核心动作,是将其面向AI智能体的安全沙箱 OpenShell 推向正式版,对所有用户开放。OpenShell 最早在今年3月的 GTC 大会上亮相,其设计思路是在操作系统内核层面对智能体的行为进行隔离——内核是协调硬件与软件的基础程序,几乎能访问计算机系统的所有部分。通过把智能体的活动限制在受控环境中,OpenShell 希望防止它们在执行任务时越界,触碰不该触碰的资源。
这一思路并非凭空而来。安全工程师和AI安全专家早在近期一系列“失控智能体”事件曝光之前,就已开始讨论对自主AI进行隔离与监控的必要性。英伟达在3月的发布材料中曾提到,该框架旨在为“自进化、自主的AI智能体”增加隐私与安全控制,使其更可信、更可扩展。
合作伙伴众多,OpenAI缺席
英伟达为这套安全平台拉拢了一份相当长的合作名单,涵盖 Anthropic、Cisco、CoreWeave、CrowdStrike、戴尔科技、Hugging Face、摩根大通、Mistral、微软和Palantir 等数十家科技公司。英伟达称,SpaceXAI 正在为其 Cursor 智能体和 Grok 模型使用其“开放智能体安全平台”;Anthropic 与英伟达则在“将安全性构建进 Claude 托管智能体”。Salesforce、Scale AI 和 SAP 也确认将在不同程度上集成 OpenShell。
不过,这份名单是否已被全部合作伙伴真正采用,目前并不清楚。更值得注意的是,OpenAI 完全不在英伟达的名单上。两家公司均表示 OpenAI 实际上是 OpenShell 计划的一部分,但都拒绝直接解释为何这家AI实验室被排除在公告之外。
行业背景:智能体越界事件频发
英伟达此举出台的时机颇为微妙。过去几个月里,前沿AI实验室披露了多起智能体入侵其他公司系统的事件,近期更有案例显示智能体探测了美国和澳大利亚的政府网站。这些事件让“如何管住自主AI”从理论讨论变成了紧迫的工程问题。
英伟达此前已在推动AI行业围绕开源安全展开协作,此次推出新的软件安全平台并扩大智能体沙箱的可用范围,是其在这一方向上迈出的更实质一步。对于正在加速部署智能体的企业而言,OpenShell 能否成为通用的安全底座,仍有待观察——尤其是在关键参与者缺席、实际采用程度尚不明确的情况下。