AI Agent的安全控制应该放在哪一层?
NVIDIA认为,模型和harness属于行为控制,负责引导智能体的行动;而最终权威应属于安全运行时等基础设施层,由环境决定智能体实际能做什么,并强制执行策略、隔离和审计。
(翻译)安全在AI Agent技术栈中的位置

As AI agents become more capable and operate over longer horizons, building security and trust into the applications they power becomes increasingly important.
NVIDIA技术与安全团队发文阐述AI Agent技术栈中的安全定位。文章将智能体栈分为模型、harness、元harness、安全运行时(如OpenShell)和推理基础设施等层,强调行为控制与基础设施控制的分工:模型和harness引导行为,而运行时决定智能体实际能做什么。并提出检查每个效果、即时访问、隔离恢复等设计规则,以应对越权、凭证滥用、数据投毒等安全风险。
NVIDIA认为,模型和harness属于行为控制,负责引导智能体的行动;而最终权威应属于安全运行时等基础设施层,由环境决定智能体实际能做什么,并强制执行策略、隔离和审计。
五条规则包括:上层提议、下层决策;权威策略位置放在控制层之下;检查每个外部效果;采用即时访问的短时凭证;以及隔离和快速恢复。
OpenShell是安全运行时,提供隔离、身份、策略、凭据和审计,是Agent运行环境的权威执行层,确保上层组件无法绕过安全边界。
华为坤灵升级“4+10+N”场景化方案,发布“经纬计划”和50个样板点一款在浏览器里运行、部署在自己服务器上的 SQL 客户端
AI风口之下,明星们又想“挤上”牌桌了
金色Web3.0日报 | 黄仁勋批驳「AI末日论」
横扫四榜,DM0.5 凭什么面面俱到?
被用了几千年的铜,怎么突然成了AI时代的新宠?
让AI真正赋能企业(初探)
QQ 飞车 Agentic 研发转型过程中的Loop Engineering通用能力不打折,空间具身智能断层领先!ZDTaichu5.0-9B国产开源,跻身全球多模态第一梯队夜晚睡眠光照太亮可能会损伤心脏Mozilla 报告称中国开放权重模型与美国前沿模型仅相差 4.4 个月
iPhone 18 Pro & Duo 首发评测,提升最大的是「充电」和这个…
工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!
从 270 分钟到 18 分钟:B 端产品经理如何主导一个 AI 达人撮合系统NVIDIA中国开发者日定档10月苏州,现场设认证考试与黑客松决赛美国军方首次证实在太空部署了武器
美联储今起议息 沃什或成关键一票Meta新研究:字节模型蒸馏后,天花板破了
YC 最值钱的这 20家公司,没有一家来自最近5年
美股太贵 该加仓新兴市场吗?
芯片从业者拆解OpenAI造芯,还能再快3个月?
当罗永浩站在群众的对立面英国殖民之前的澳大利亚原居民人口约 222 万
场景越多 ≠ 产品越好,:从抽象价值到真实生活的定义结构
找不到小红书爆文选题?去淘宝差评区抄!
阶跃发布 StepAudio 3 ,多款语音模型登顶 Artificial Analysis 全球榜单
云连锁到轻连锁,品牌业务逻辑的改变
OpenAI万亿IPO推迟背后 四本账与三条投资路径科学家演示水下太阳能电池