给AI加一道外部边界:NVIDIA推出代理安全平台
AI代理
能代表人读取资料、调用工具并完成任务的AI程序。
OpenShell
限制AI可访问内容和操作范围的软件。
Sentry
在代理外部监视行动并阻止越界的安全层。
发生了什么
NVIDIA(为AI制造芯片的公司)在9月28日发布 NVIDIA Open Agent Safety Platform。这是一套面向AI代理的安全方案。AI代理不是只会回答问题的聊天工具,它还可以读取文件、调用工具、编写代码,并持续推进任务。NVIDIA发布说明
方案有两层。OpenShell是开源软件,为AI代理建立一个可以执行的边界。Sentry则是边界外的独立监视设计。NVIDIA说,Sentry运行在BlueField-4 DPU(数据处理芯片)上。代理如果试图越过规定范围,Sentry可以在几毫秒内把它隔离。
标题里的看门芯片是对这个想法的简化说法。它不表示每个AI代理都会自动配上一块实体芯片。NVIDIA发布的是平台和参考设计,Sentry的实际部署方式还要看组织采用的方案。
为什么现在需要它
AI代理能替人执行任务,所以它接触的文件、网络、账户和工具比普通聊天机器人更多。任务越长,越可能遇到含糊的指令、失效的工具或错误的下一步。NVIDIA认为,不能只要求代理自己管住自己。外部边界的目标,是在代理判断出错时,先限制它能碰到的东西。
两层怎样配合
OpenShell把每个代理放进受限的工作空间。管理者可以规定它能读取哪些文件、访问哪些网络、使用哪些工具和登录信息。规则在代理进程外执行,因此不只依赖模型是否愿意遵守。OpenShell是开源的,NVIDIA称它可以扩展到Arm和Intel平台。
Sentry提供另一道边界。它在BlueField-4硬件上独立观察代理行为。NVIDIA称,如果代理试图离开软件边界,Sentry可以把它隔离。简单说,OpenShell负责划定可活动的区域,Sentry负责检查是否越界。
为什么重要
这改变了安全思路。过去人们常把重点放在给模型写更好的指令上。现在还可以用外部规则限制模型真正能访问的资料和工具。这样不能让模型永远正确,却可能缩小一次错误的影响范围。
但边界不是越紧越好。规则太严,会挡住有用的工作;规则太松,又可能放行危险动作。部署组织仍要自己写规则。平台也不会自动消除模型的误判或错误说明。
已确认的事实,以及HN上的热度
NVIDIA称,OpenShell已经可以广泛使用,平台发布时有100多个组织在使用。AP报道列出了Microsoft、Perplexity、Accenture和JPMorgan Chase等名称。(AP报道) NVIDIA的公告还把Anthropic和SpaceXAI列为参与者。
Hacker News这条消息有82 points和131 comments。(讨论页) 这些数字只表示社区关注度,不证明平台一定安全,也不证明NVIDIA的说法已经被独立证实。
仍然未知的部分
几毫秒内隔离的性能,以及平台能阻止过去某些事件的说法,主要来自NVIDIA自己的说明。独立测试还需要回答两个问题:它能否挡住有害动作,又不误伤有用动作?它在长时间、复杂任务中是否仍可靠?
威斯康星大学计算机科学家Somesh Jha提醒,限制可能会阻止代理完成有用工作。他认为需要案例研究。由此看,发布平台只是开始,效果不能只看演示。
接下来要看什么
接下来应看OpenShell的真实部署、独立评估,以及发生失败后规则如何修改。真正重要的不是有没有一个监视器,而是组织能否说清代理能做什么、做过什么,以及为什么被允许或被拦住。
NVIDIA给AI安排了外部看守
📰 完整报道: 给AI加一道外部边界:NVIDIA推出代理安全平台
AI代理可以替人做很多事,也可能走出允许的范围。NVIDIA希望用外部系统把它拦住。
AI代理
能替人读取资料、使用工具并完成任务的AI。
OpenShell
规定AI能看什么、能用什么的软件。
Sentry
从外面观察AI动作的安全系统。
💡 一句话总结
- NVIDIA发布了AI代理安全方案。
- OpenShell管住AI能做什么,Sentry从外面观察。
- Hacker News有82 points和131 comments。热度不等于正确。
NVIDIA(为AI制造芯片的公司)在9月28日发布了方案。它叫 NVIDIA Open Agent Safety Platform(AI代理安全平台)。
AI代理能替人做事。它能读文件、用工具,还能继续完成长任务。能力越多,走错一步时,影响可能越大。
OpenShell是开源软件。它给每个AI代理划出受限的工作区。管理者可以规定它能读哪些文件、用哪些工具。规则在AI外面执行。这样就不只靠AI自己记住要求。
Sentry是另一层看守。它在外面看AI的动作。NVIDIA说,AI越出规定范围时,Sentry可以把它隔离。Sentry的参考设计使用BlueField-4 DPU。标题说的看守芯片,不代表每个AI都会自动得到一块芯片。
NVIDIA说,发布时有100多个组织在使用这套方案。AP也报道了这个说法。这是企业提供的数字。它实际能否挡住危险动作,还需要独立测试。
如果规则太窄,AI可能做不了有用的事。如果规则太宽,危险动作可能被放行。下一步要看真实部署和测试结果。
💬 看门芯片真的能让 AI 代理更安全吗?
HN评论者意见不一:有人把芯片看作有用的安全层,也有人认为应该直接隔离代理,并担心对英伟达产生依赖。
- 芯片可以是可选的,所以不会阻止别人开发其他方案。但有人担心,厂商出售自己的安全硬件,最后会造成厂商锁定。
- “隔离网”就是切断代理的网络。它在某些测试中更安全,但代理需要网页、GitHub或部署服务时会很不方便。因此有人认为,在无法完全隔离的场景中,现成芯片很实用;也有人认为根本不该给代理这么大的网络权限。
- 虚拟机、有限权限和监控可以隔离不受信任的软件。但代理仍可能滥用被允许的浏览器或网络路径,把数据泄露出去。
- 禁止所有网络,只允许类似人类点击和输入的操作,可能更安全,但准备工作更多、代理能做的事情更少。被污染的提示词或上下文仍可能造成问题。
- 沙箱可以减少软件攻击,却不能单独阻止代理欺骗人或滥用已有权限。人工检查能提高安全性,但会让工作变慢。
这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。
给AI小帮手画一条线
📰 完整报道: 给AI加一道外部边界:NVIDIA推出代理安全平台
AI小帮手会做事。NVIDIA想让它在安全的地方做事。
OpenShell
给AI的工作画线的软件。
Sentry
在AI外面看守的办法。
发生了什么
NVIDIA(做AI芯片的公司)提出了一个办法。 AI小帮手能帮人做事。 它能看文件,也能用工具。 它有时会走错路。
OpenShell(给工作画线的软件)像一圈小围墙。 它告诉AI能看什么。 也告诉AI能用什么。
Sentry(在外面看守的办法)像门口的看守。 AI越过线时,它可以把AI停下。 NVIDIA说,它能很快做到。
人还是要画好这条线。 线太窄,好的工作也做不了。 线太宽,坏的动作可能被放行。
Hacker News是谈技术的网站。 它有82 points和131 comments。 这表示有人关注。 不表示这个办法一定正确。
💬 AI旁边的小卫兵
英伟达想在每个 AI 小帮手旁边放一个看门芯片。大家在争论这个小卫兵有没有用。
- 有人觉得它是好用的安全工具。也有人担心,卖芯片的公司会让大家依赖它。
- 把 AI 和互联网隔开会更安全,但 AI 也会因此做不了很多工作。小盒子和少量钥匙能帮忙关住它,可它仍可能从允许的路把数据带出去,或骗到别人。
- 把所有网络都关掉可能更安全,但工作会更慢、更难。坏提示词或坏信息也可能把 AI 弄糊涂。
- 所以,一个芯片不能解决全部问题。人还要检查 AI,并决定它能打开哪些门。
这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。
💬 围绕 AI 代理看门芯片的隔离、自由与实用性之争
HN评论者分成两派:一派认为英伟达的看门芯片是现实的安全措施,另一派认为简单的网络隔离就够了,并担心芯片会带来厂商锁定。争论的核心是:应该给代理多少权限,以及谁来阻止它出错或被滥用。
这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。