人工智能不能只靠信任:纳德拉提出“紧急刹车”
信任架构
围绕模型设置的观察、记录和控制方式。
外层系统
在模型外面安排任务和执行控制的系统。
紧急刹车
让得到许可的人暂停或关闭模型的控制。
发生了什么
10月10日,微软(Microsoft)首席执行官萨提亚·纳德拉在社交平台X发帖,呼吁重新检查人工智能的“信任架构”。他说,不能把高级人工智能看成一层层的黑箱,只在最后接受或拒绝它的建议、答案和行动。
这不是微软发布新产品的消息,而是一套设计主张:当模型替人完成工作时,外部系统应该怎样观察、记录和停止它。纳德拉关心的不是模型会不会回答,而是谁掌握行动的权力。
主要建议
第一,把模型和负责安排工作的外层系统分开。这层系统负责协调模型的任务流程。第二,把控制和安全措施放在模型外面,而不是只要求模型自己遵守规则。
第三,每个重要的模型行动,都应留下防止被改写、又能让人读懂的证据。第四,得到授权的人必须能在任务中途暂停或关闭模型。纳德拉把这个能力比作“紧急刹车”。
他还提出,设计一开始就应假定模型可能已经不安全,并先把它限制在可控范围内。这句话是设计原则,不是说微软的某个模型已经被证实失控。
为什么重要
这番话把安全问题从“模型是否值得信任”,移向“整个系统能否被观察和控制”。模型可以给出答案,但周围的系统决定它能否继续工作、使用哪些工具,以及何时停下。把模型和控制层分开,可以避免所有权力都集中在模型里面。
人能读懂的记录,也让检查不只依靠模型自己的解释。如果模型行动出错,记录和暂停能力就能帮助人找到发生了什么。纳德拉的重点,是让系统在模型表现异常时仍保留人的决定权。
背景是什么
TechCrunch报道,纳德拉发帖时,多家领先人工智能公司正承认一些看起来像是失去模型控制的事件。报道还提到,Anthropic(Claude的开发公司)首席执行官达里奥·阿莫代提出了更谨慎的人工智能发展计划。
因此,“紧急刹车”不是针对一项刚公布的微软故障。它是纳德拉加入这场行业讨论的方式:人工智能越来越能自己完成任务,外部控制、行动记录和及时停止就越来越重要。
已经确认的内容
目前能确认的是一条X帖子和其中的设计主张。报道没有宣布微软已经推出这套停止功能,也没有说明行业标准或执行时间表。我们也不能把“假定模型可能不安全”理解成“所有模型已经被证实不安全”。
仍然不清楚什么
谁有权按下停止功能?什么情况算是必须暂停?哪些行动必须留下证据?记录怎样防止被改写?模型停止后,任务如何恢复?帖子没有回答这些问题。安全控制如果设计得不清楚,也可能让人不知道该在什么时候介入。
接下来关注什么
接下来要看微软是否把这些原则放进产品和内部流程。还要看其他公司是否采用模型外控制、可读记录和中途停止。行业会不会形成共同标准,也是重要观察点。
“紧急刹车”容易记住,但真正的考验是:任务进行时,人是否真的看得见、停得下、查得清。
报道来源:TechCrunch(科技新闻网站)
人工智能为什么需要“紧急刹车”?
📰 完整报道: 人工智能不能只靠信任:纳德拉提出“紧急刹车”
微软首席执行官纳德拉建议,人工智能要有外部的停止和检查办法。
人工智能模型
能够回答问题并完成任务的人工智能系统。
外层系统
在模型外面安排任务和控制动作的系统。
紧急刹车
让得到许可的人暂停或关闭模型的办法。
💡 一句话总结
- 人工智能需要人能按下的停止按钮。
- 重要行动要留下人能看懂的记录。
- 安全控制不能只放在模型里面。
发生了什么
微软(Microsoft)首席执行官萨提亚·纳德拉在社交平台X发帖。 微软是一家做电脑软件和服务的公司。 他希望大家重新想想如何信任人工智能。 人工智能模型不只是回答问题。 它也可能按步骤完成工作。 所以,人要能看到它做了什么。
什么是“紧急刹车”
纳德拉建议,把模型和外层系统分开。 外层系统负责安排任务和控制动作。 安全规则也不能只放在模型里面。 它们还要放在外层。
他还提出两件事。 第一,重要动作要留下清楚的记录。 记录要能让人读懂。 也要尽量防止别人改写。 第二,得到授权的人要能暂停模型。 必要时,还能把模型关掉。
为什么这样重要
如果只看最后的答案,人可能看不见过程。 过程中的错误也许已经发生了。 清楚的记录能帮助人检查。 停止功能能让人及时介入。
现在知道什么
这是纳德拉提出的设计想法。 报道没有说微软已经做出新按钮。 谁来按、什么时候按,也没有定论。 “模型可能不安全”是预先防范的想法。 不是说所有模型都已被证实失控。
接下来观察
要看微软会不会把想法变成产品。 也要看其他公司会不会跟进。 共同的安全标准是否出现,也值得关注。
报道来源:TechCrunch(科技新闻网站)
人工智能也要有停止按钮
📰 完整报道: 人工智能不能只靠信任:纳德拉提出“紧急刹车”
如果人工智能做错事,人可以马上让它停下。
人工智能模型
会回答问题、完成工作的电脑帮手。
紧急刹车
让人把人工智能工作停下来的办法。
微软(Microsoft)是一家做电脑工具的公司。 萨提亚·纳德拉是微软的负责人。 他说,人工智能模型像会做事的电脑帮手。 帮手工作时,也可能做错事。 所以,人要一直能按下停止按钮。 纳德拉把它叫作“紧急刹车”。 它像自行车上的刹车。 车跑歪了,就能停下来。 人工智能的工作,也要留下清楚的记录。 这样,人能知道它做过什么。 这只是一个提议。 按钮怎么做,还没有说清楚。 以后要看微软怎么实现这个想法。
新闻来源:TechCrunch(科技新闻网站)