本页目录7
AI 摘要 · 已核查整理于 2026-09-29原文:Giving companies more control over their AI agents, with NVIDIA(Anthropic)子代理与多 Agent权限与安全
要点速览
- Anthropic 与 NVIDIA 合作发布 Open Agent Safety Platform,面向企业级智能体部署
- 防护分多层:模型自身的安全机制加外部控制,各层相互独立,避免单点失效
- Claude Managed Agents 把智能体逻辑与沙箱执行环境分离,凭证存放在隔离的保险库中,智能体不会直接接触密码或密钥
- NVIDIA OpenShell 是 Apache 2.0 开源运行时,默认拒绝一切未被明确允许的操作,并记录每一次决策
- 架构是模块化的,企业可以按自身基础设施选用需要的组件
本文是对官方文章《Giving companies more control over their AI agents, with NVIDIA》的中文要点摘要,完整内容以原文为准:https://claude.com/blog/giving-companies-more-control-over-their-ai-agents-with-nvidia
背景与主旨
这篇文章发布于 2026 年 9 月 28 日,介绍 Anthropic 与 NVIDIA 合作推出的 Open Agent Safety Platform。它把安全控制集成进 Claude Managed Agents。目标是让企业把智能体部署到生产环境时,仍能严格管控智能体可以做什么、能访问什么。
防护架构:多层且相互独立
原文强调的思路是分层防御:
- 一部分安全能力内建在模型中,另一部分来自模型之外的控制。
- 每一层独立运行,任何一层出问题都不会让整体失效。
- 设计是模块化的,企业可以根据自己的基础设施选用相关组件,不必整体采纳。
Claude Managed Agents 提供的能力
| 方面 | 要点 |
|---|---|
| 执行隔离 | 智能体逻辑与沙箱执行环境分离运行 |
| 凭证管理 | 凭证放在隔离的保险库里,智能体不直接接触密码或密钥 |
| 审计 | 提供审计轨迹,记录智能体的所有操作 |
| 权限集成 | 可对接企业现有的访问控制系统 |
| 沙箱部署 | 支持自定义沙箱,可部署在企业自有基础设施或托管服务商上 |
原文还提到,长时间运行的会话可以自主工作数小时,并支持多智能体编排来并行处理复杂任务。
NVIDIA OpenShell:策略执行运行时
OpenShell 是 NVIDIA 的开源安全运行时,采用 Apache 2.0 许可证,代码在 GitHub 上。文中列出的特点:
- 通过策略执行来监控并管控智能体的全部行为。
- 默认拒绝:除非被明确允许,否则一律阻止。
- 带有一个数学化的策略证明器,用来验证智能体可以访问哪些资源。
- 记录每一次决策,便于事后审计。
文中提到的客户场景
- Notion:在工作区内并行执行任务。
- Rakuten:在五个部门部署专业智能体。
- Asana:集成 AI Teammates,自主管理任务。
可用性
原文称相关能力已可使用,OpenShell 可通过 NVIDIA 的开发者资源获取。
对开发者的参考价值
- 设计自己的智能体系统时,可以借鉴「逻辑与执行环境分离、凭证不进入智能体上下文、默认拒绝加审计」这套思路。
- 权限治理不必依赖单一机制,模型层与运行时层的控制可以叠加。
- 具体的接入方式、配置项和限制,原文未展开,请以官方文档和原文为准。