视频号
    标题 摘要 内容
    详情

    近日,NVIDIA(英伟达)正式推出开放智能体安全平台(NVIDIA Open Agent Safety Platform),依托开源运行时软件 OpenShell 与基于 BlueField-4 DPU 打造的 Sentry 硬件参考系统,构建面向 AI 智能体的全栈安全治理体系,通过芯片级带外监控能力,可在数毫秒内对越界、失控的 AI 智能体实施隔离,为自主智能体从测试、验证到规模化商用部署建立硬件与软件双重安全护栏。


    图片


    随着 AI 智能体逐步具备自主调用工具、访问系统、执行复杂任务的能力,传统依赖模型内置对齐、操作系统层面的安全防护存在明显短板。一旦智能体出现 “越狱”、越权访问、行为失控等风险,软件层面防护容易被逃逸,难以快速阻断风险扩散。英伟达本次推出的开放智能体安全平台,采用带外独立安全架构,安全监控与执行单元独立于 AI 智能体运行环境,智能体本身无法感知、篡改或关闭安全管控机制,解决传统 AI 安全方案 “被保护对象可绕过安全规则” 的痛点。


    该平台由两大核心组件协同构成: 一是OpenShell 开源安全运行时,部署于 NVIDIA Vera CPU,提供沙箱化执行环境与内核级隔离能力。OpenShell 持续追踪 AI 智能体全部操作行为,对文件访问、系统调用、网络连接、凭证调用实施细粒度权限管控,强制执行预设安全策略。OpenShell 采用 Apache2.0 开源协议,支持跨硬件平台运行,兼容 Arm、Intel 等第三方计算硬件,企业可自由集成到自有 AI 智能体开发、测试与生产环境中。


    二是Sentry 芯片级安全监控参考系统,运行在 BlueField-4 DPU 数据处理器上,作为独立硬件看门狗,持续、线速采集智能体全链路行为数据。Sentry 位于智能体访问大模型的唯一通路,依托 DOCA 开发套件实现上下文行为关联、身份核验与策略校验。一旦检测到智能体越界、异常行为,Sentry 可在毫秒级完成隔离与阻断,在风险扩散前切断失控智能体访问权限,实现硬件层硬熔断能力,不占用主机算力,不影响正常 AI 业务性能。


    平台遵循五大核心设计原则:策略可验证、带外强制管控、管控模型访问通路、智能体权限与推理可见性匹配、全产业链共担安全责任,覆盖软件、硬件、算力、机器人系统的全栈治理,适配本地、私有云、混合云、离线隔离等多种部署场景,支持大模型、企业智能体、机器人智能体等各类自主 Agent 应用的安全管控需求。


    本次平台发布同步集结了 AI 生态跨行业合作伙伴,Anthropic、微软、Hugging Face、摩根大通、思科、戴尔、HPE、Figure、SAP、Salesforce 等上百家企业共同参与,共建 AI 智能体安全生态,统一安全实践标准,推动行业形成可落地、可验证的智能体安全部署规范。