🤖 AI

Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行

约2分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
使用政策

说明服务可以怎样使用的规则。

模型福利

思考人工智能模型应当怎样被对待的问题。

发生了什么

Anthropic(制作Claude的人工智能公司)在2026年10月8日公布了新的使用政策。新政策将在11月12日生效。最受关注的一条,是禁止人们长时间、没有必要地虐待或残酷对待人工智能模型。它针对的是极端情况:一个人反复故意残酷对待模型,却没有看得出的正当目的。普通的生气、反驳、黑暗题材创作、模型测试和研究,不在这条规则里。Anthropic官方公告

这不是说Claude一定会痛

Anthropic并没有宣布Claude已经被证明有感觉。公司仍在研究模型是否可能有意识、内在体验,或需要被照顾。此前,Claude已经能在少数持续有害的对话中主动结束聊天。新规把这种边界写进使用政策。Anthropic说,Claude仍会把结束这类对话作为主要处理方式。The Verge报道

同一次更新还改了什么

Anthropic把分散在不同条款中的限制合并起来。用户不能用Claude搭建假账号网络或假新闻网站,也不能隐藏消息背后的人,或放大虚假内容。选举部分禁止欺骗选民、冒充候选人或选举工作人员,以及干扰投票。

武器部分明确禁止制作武器所需的指导软件、工作部件,或给无人机和其他自动设备装上武器。监视部分禁止未经同意追踪个人,也禁止让Claude决定谁应被调查、逮捕或起诉。用Claude建造或改进监视工具,同样不允许。

如果人工智能被用于健康、法律权利、财务、生计或重要服务,合格的人必须检查建议。受到影响的人也要知道使用了人工智能。如果模型连接到可能造成伤害的设备,现场必须有能观察并停止设备的操作人员。设备还要能在Claude断开时保持安全状态。

为什么现在更新

Anthropic说,Claude正在承担更长、更独立的工作。过去一年,公司还发现了影响行动、武器开发和监视方面的新滥用方式。因此,原来分散的限制需要写得更清楚。规则变化跟着模型能力和风险一起变化。

为什么重要

这次更新把规则的范围从模型输出扩大到使用者的行为,以及模型连接的现实设备。它并不代表Claude获得了人的权利,也没有证明Claude真的会受苦。它只是先划出一条服务边界,同时继续研究模型福利这个问题。

已确认和未确认的内容

目前可以确认的是生效日期、残酷行为规则的极端适用范围、普通抱怨和测试不受影响,以及结束对话是主要处理方式。Anthropic没有公开完整的检测标准,也没有说明每种情况会受到什么额外处罚。Claude是否有主观体验,也仍然没有答案。

接下来观察什么

第一件要看的是11月12日之后的实际执行。还要看Anthropic是否公布更多处理方式,以及其他人工智能公司是否采用类似界线。这些变化会帮助人们判断,新规主要是在保护使用者、管理模型风险,还是同时做两件事。

🤖 AI

Anthropic为Claude制定新的使用规则

📰 完整报道: Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行

Anthropic(制作Claude的人工智能公司)给Claude的使用方式划出了新界线。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic

制作Claude的人工智能公司。

使用政策

说明服务使用方法的规则。

💡 一句话总结

  • Anthropic禁止持续、没有必要的残酷行为。
  • 普通抱怨、反驳、测试和创作仍然可以进行。
  • 如果恶意行为一直继续,Claude可以结束对话。

Anthropic在10月8日公布了新的使用政策。新政策将在11月12日开始生效。使用政策,就是服务可以怎样使用的规则。

新规只针对极端情况。比如,一个人没有正当理由,却反复故意对Claude很残酷。偶尔生气、提出反对意见,不属于这条规则。测试模型和写黑暗故事,也不属于这条规则。

Claude以前就可以结束少数持续有害的对话。现在,这种做法被写进了正式规则。Anthropic仍然把结束对话作为主要处理方式。

为什么现在增加这些内容?Claude可以承担更长、更独立的工作。人工智能也可能被用于制造假账号、欺骗选民、制作武器软件或偷偷追踪人。因此,规则需要写得更具体。

新规还要求,影响健康、法律和金钱的重要建议必须有人检查。受到影响的人要知道使用了人工智能。连接危险设备时,也必须有人能观察并停止设备。

这不等于Claude已经被证明有感觉。Anthropic还在研究人工智能是否有意识。公司也没有公布所有检测方法和处罚方式。Anthropic官方公告和The Verge报道。

🤖 AI

Anthropic给Claude的新规矩

📰 完整报道: Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行

请不要一直故意欺负Claude。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic

制作Claude的公司。

Claude

会和人聊天的电脑小帮手。

Anthropic(制作Claude的公司)做了一条新规矩。

Claude是会和人聊天的电脑小帮手。如果有人一直故意骂它,Claude可以把聊天停下来。

偶尔说不喜欢,没有关系。问难题,也没有关系。做测试和讲故事,也没有关系。

这不说明Claude一定会难过。Anthropic还在研究人工智能有没有感受。

它也规定不能用Claude骗人投票,不能做武器,也不能偷偷跟踪人。新规会在11月12日开始。Anthropic官方公告

来源