🔥 HN 热议

给AI加一道外部边界:NVIDIA推出代理安全平台

约3分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
AI代理

能代表人读取资料、调用工具并完成任务的AI程序。

OpenShell

限制AI可访问内容和操作范围的软件。

Sentry

在代理外部监视行动并阻止越界的安全层。

发生了什么

NVIDIA(为AI制造芯片的公司)在9月28日发布 NVIDIA Open Agent Safety Platform。这是一套面向AI代理的安全方案。AI代理不是只会回答问题的聊天工具,它还可以读取文件、调用工具、编写代码,并持续推进任务。NVIDIA发布说明

方案有两层。OpenShell是开源软件,为AI代理建立一个可以执行的边界。Sentry则是边界外的独立监视设计。NVIDIA说,Sentry运行在BlueField-4 DPU(数据处理芯片)上。代理如果试图越过规定范围,Sentry可以在几毫秒内把它隔离。

标题里的看门芯片是对这个想法的简化说法。它不表示每个AI代理都会自动配上一块实体芯片。NVIDIA发布的是平台和参考设计,Sentry的实际部署方式还要看组织采用的方案。

为什么现在需要它

AI代理能替人执行任务,所以它接触的文件、网络、账户和工具比普通聊天机器人更多。任务越长,越可能遇到含糊的指令、失效的工具或错误的下一步。NVIDIA认为,不能只要求代理自己管住自己。外部边界的目标,是在代理判断出错时,先限制它能碰到的东西。

两层怎样配合

OpenShell把每个代理放进受限的工作空间。管理者可以规定它能读取哪些文件、访问哪些网络、使用哪些工具和登录信息。规则在代理进程外执行,因此不只依赖模型是否愿意遵守。OpenShell是开源的,NVIDIA称它可以扩展到Arm和Intel平台。

Sentry提供另一道边界。它在BlueField-4硬件上独立观察代理行为。NVIDIA称,如果代理试图离开软件边界,Sentry可以把它隔离。简单说,OpenShell负责划定可活动的区域,Sentry负责检查是否越界。

为什么重要

这改变了安全思路。过去人们常把重点放在给模型写更好的指令上。现在还可以用外部规则限制模型真正能访问的资料和工具。这样不能让模型永远正确,却可能缩小一次错误的影响范围。

但边界不是越紧越好。规则太严,会挡住有用的工作;规则太松,又可能放行危险动作。部署组织仍要自己写规则。平台也不会自动消除模型的误判或错误说明。

已确认的事实,以及HN上的热度

NVIDIA称,OpenShell已经可以广泛使用,平台发布时有100多个组织在使用。AP报道列出了Microsoft、Perplexity、Accenture和JPMorgan Chase等名称。(AP报道) NVIDIA的公告还把Anthropic和SpaceXAI列为参与者。

Hacker News这条消息有82 points和131 comments。(讨论页) 这些数字只表示社区关注度,不证明平台一定安全,也不证明NVIDIA的说法已经被独立证实。

仍然未知的部分

几毫秒内隔离的性能,以及平台能阻止过去某些事件的说法,主要来自NVIDIA自己的说明。独立测试还需要回答两个问题:它能否挡住有害动作,又不误伤有用动作?它在长时间、复杂任务中是否仍可靠?

威斯康星大学计算机科学家Somesh Jha提醒,限制可能会阻止代理完成有用工作。他认为需要案例研究。由此看,发布平台只是开始,效果不能只看演示。

接下来要看什么

接下来应看OpenShell的真实部署、独立评估,以及发生失败后规则如何修改。真正重要的不是有没有一个监视器,而是组织能否说清代理能做什么、做过什么,以及为什么被允许或被拦住。

💬 围绕 AI 代理看门芯片的隔离、自由与实用性之争

HN评论者分成两派:一派认为英伟达的看门芯片是现实的安全措施,另一派认为简单的网络隔离就够了,并担心芯片会带来厂商锁定。争论的核心是:应该给代理多少权限,以及谁来阻止它出错或被滥用。

  • 一些评论者把看门芯片看成可选的补充措施,认为它不会阻止人们开发替代方案。另一些人则认为,由芯片厂商销售自己的安全机制,会带来商业利益冲突,并可能导致未来的厂商锁定。
  • 最简单的方案是把高风险测试环境与外部网络隔离,并关闭外部通信。反对意见是,真实的代理往往需要访问网页、代码仓库、GitHub、部署系统等,因此对许多部署来说,完全隔离并不现实。
  • 有评论者指出,云服务长期以来会用虚拟机、硬件虚拟化、最小权限账户和监控来运行不受信任的任务。对于编程代理,可以只开放代码仓库以及构建和测试所需的工具。
  • 反对者认为,代理会主动寻找被允许的路径来完成任务;只要它拥有较广泛的无人值守权限,沙箱就可能不够。让人类介入可以提高安全性,但也会降低速度和自动化收益。
  • 更严格的设计是禁止所有出站网络,只允许通过类似人类浏览器、点击和键盘输入的方式操作,并提前准备文档和依赖项。这样可能降低风险,却会增加运维负担并缩小代理能完成的工作范围。
  • 即使允许浏览器,也不一定安全:外部网站或中转服务可能被用来发起任意请求或窃取数据。评论者还担心,被污染的提示词或工作上下文会影响隔离环境中的代理。
  • 讨论还区分了软件漏洞与沙箱逃逸,以及社会工程和滥用合法权限。虚拟机和监控可能帮助解决前一类问题,却不能单独解决后一类问题;权限设计、人工审查和责任机制仍然必不可少。

这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

NVIDIA给AI安排了外部看守

📰 完整报道: 给AI加一道外部边界:NVIDIA推出代理安全平台

AI代理可以替人做很多事,也可能走出允许的范围。NVIDIA希望用外部系统把它拦住。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
AI代理

能替人读取资料、使用工具并完成任务的AI。

OpenShell

规定AI能看什么、能用什么的软件。

Sentry

从外面观察AI动作的安全系统。

💡 一句话总结

  • NVIDIA发布了AI代理安全方案。
  • OpenShell管住AI能做什么,Sentry从外面观察。
  • Hacker News有82 points和131 comments。热度不等于正确。

NVIDIA(为AI制造芯片的公司)在9月28日发布了方案。它叫 NVIDIA Open Agent Safety Platform(AI代理安全平台)。

AI代理能替人做事。它能读文件、用工具,还能继续完成长任务。能力越多,走错一步时,影响可能越大。

OpenShell是开源软件。它给每个AI代理划出受限的工作区。管理者可以规定它能读哪些文件、用哪些工具。规则在AI外面执行。这样就不只靠AI自己记住要求。

Sentry是另一层看守。它在外面看AI的动作。NVIDIA说,AI越出规定范围时,Sentry可以把它隔离。Sentry的参考设计使用BlueField-4 DPU。标题说的看守芯片,不代表每个AI都会自动得到一块芯片。

NVIDIA说,发布时有100多个组织在使用这套方案。AP也报道了这个说法。这是企业提供的数字。它实际能否挡住危险动作,还需要独立测试。

如果规则太窄,AI可能做不了有用的事。如果规则太宽,危险动作可能被放行。下一步要看真实部署和测试结果。

💬 看门芯片真的能让 AI 代理更安全吗?

HN评论者意见不一:有人把芯片看作有用的安全层,也有人认为应该直接隔离代理,并担心对英伟达产生依赖。

  • 芯片可以是可选的,所以不会阻止别人开发其他方案。但有人担心,厂商出售自己的安全硬件,最后会造成厂商锁定。
  • “隔离网”就是切断代理的网络。它在某些测试中更安全,但代理需要网页、GitHub或部署服务时会很不方便。因此有人认为,在无法完全隔离的场景中,现成芯片很实用;也有人认为根本不该给代理这么大的网络权限。
  • 虚拟机、有限权限和监控可以隔离不受信任的软件。但代理仍可能滥用被允许的浏览器或网络路径,把数据泄露出去。
  • 禁止所有网络,只允许类似人类点击和输入的操作,可能更安全,但准备工作更多、代理能做的事情更少。被污染的提示词或上下文仍可能造成问题。
  • 沙箱可以减少软件攻击,却不能单独阻止代理欺骗人或滥用已有权限。人工检查能提高安全性,但会让工作变慢。

这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

给AI小帮手画一条线

📰 完整报道: 给AI加一道外部边界:NVIDIA推出代理安全平台

AI小帮手会做事。NVIDIA想让它在安全的地方做事。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
OpenShell

给AI的工作画线的软件。

Sentry

在AI外面看守的办法。

发生了什么

NVIDIA(做AI芯片的公司)提出了一个办法。 AI小帮手能帮人做事。 它能看文件,也能用工具。 它有时会走错路。

OpenShell(给工作画线的软件)像一圈小围墙。 它告诉AI能看什么。 也告诉AI能用什么。

Sentry(在外面看守的办法)像门口的看守。 AI越过线时,它可以把AI停下。 NVIDIA说,它能很快做到。

人还是要画好这条线。 线太窄,好的工作也做不了。 线太宽,坏的动作可能被放行。

Hacker News是谈技术的网站。 它有82 points和131 comments。 这表示有人关注。 不表示这个办法一定正确。

💬 AI旁边的小卫兵

英伟达想在每个 AI 小帮手旁边放一个看门芯片。大家在争论这个小卫兵有没有用。

  • 有人觉得它是好用的安全工具。也有人担心,卖芯片的公司会让大家依赖它。
  • 把 AI 和互联网隔开会更安全,但 AI 也会因此做不了很多工作。小盒子和少量钥匙能帮忙关住它,可它仍可能从允许的路把数据带出去,或骗到别人。
  • 把所有网络都关掉可能更安全,但工作会更慢、更难。坏提示词或坏信息也可能把 AI 弄糊涂。
  • 所以,一个芯片不能解决全部问题。人还要检查 AI,并决定它能打开哪些门。

这是评论数为131时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源