Claude Code 学习站

Claude Managed Agents 联手 NVIDIA OpenShell:给企业 AI 智能体加上可控的安全层

Anthropic 与 NVIDIA 发布 Open Agent Safety Platform,把 OpenShell 运行时的策略管控接入 Claude Managed Agents,让企业在生产环境里对智能体的行为与权限保持控制。

本页目录7
要点速览
  • Anthropic 与 NVIDIA 合作发布 Open Agent Safety Platform,面向企业级智能体部署
  • 防护分多层:模型自身的安全机制加外部控制,各层相互独立,避免单点失效
  • Claude Managed Agents 把智能体逻辑与沙箱执行环境分离,凭证存放在隔离的保险库中,智能体不会直接接触密码或密钥
  • NVIDIA OpenShell 是 Apache 2.0 开源运行时,默认拒绝一切未被明确允许的操作,并记录每一次决策
  • 架构是模块化的,企业可以按自身基础设施选用需要的组件

本文是对官方文章《Giving companies more control over their AI agents, with NVIDIA》的中文要点摘要,完整内容以原文为准:https://claude.com/blog/giving-companies-more-control-over-their-ai-agents-with-nvidia

背景与主旨

这篇文章发布于 2026 年 9 月 28 日,介绍 Anthropic 与 NVIDIA 合作推出的 Open Agent Safety Platform。它把安全控制集成进 Claude Managed Agents。目标是让企业把智能体部署到生产环境时,仍能严格管控智能体可以做什么、能访问什么。

防护架构:多层且相互独立

原文强调的思路是分层防御:

  • 一部分安全能力内建在模型中,另一部分来自模型之外的控制。
  • 每一层独立运行,任何一层出问题都不会让整体失效。
  • 设计是模块化的,企业可以根据自己的基础设施选用相关组件,不必整体采纳。

Claude Managed Agents 提供的能力

方面要点
执行隔离智能体逻辑与沙箱执行环境分离运行
凭证管理凭证放在隔离的保险库里,智能体不直接接触密码或密钥
审计提供审计轨迹,记录智能体的所有操作
权限集成可对接企业现有的访问控制系统
沙箱部署支持自定义沙箱,可部署在企业自有基础设施或托管服务商上

原文还提到,长时间运行的会话可以自主工作数小时,并支持多智能体编排来并行处理复杂任务。

NVIDIA OpenShell:策略执行运行时

OpenShell 是 NVIDIA 的开源安全运行时,采用 Apache 2.0 许可证,代码在 GitHub 上。文中列出的特点:

  • 通过策略执行来监控并管控智能体的全部行为。
  • 默认拒绝:除非被明确允许,否则一律阻止。
  • 带有一个数学化的策略证明器,用来验证智能体可以访问哪些资源。
  • 记录每一次决策,便于事后审计。

文中提到的客户场景

  • Notion:在工作区内并行执行任务。
  • Rakuten:在五个部门部署专业智能体。
  • Asana:集成 AI Teammates,自主管理任务。

可用性

原文称相关能力已可使用,OpenShell 可通过 NVIDIA 的开发者资源获取。

对开发者的参考价值

  • 设计自己的智能体系统时,可以借鉴「逻辑与执行环境分离、凭证不进入智能体上下文、默认拒绝加审计」这套思路。
  • 权限治理不必依赖单一机制,模型层与运行时层的控制可以叠加。
  • 具体的接入方式、配置项和限制,原文未展开,请以官方文档和原文为准。