Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行
使用政策
说明服务可以怎样使用的规则。
模型福利
思考人工智能模型应当怎样被对待的问题。
发生了什么
Anthropic(制作Claude的人工智能公司)在2026年10月8日公布了新的使用政策。新政策将在11月12日生效。最受关注的一条,是禁止人们长时间、没有必要地虐待或残酷对待人工智能模型。它针对的是极端情况:一个人反复故意残酷对待模型,却没有看得出的正当目的。普通的生气、反驳、黑暗题材创作、模型测试和研究,不在这条规则里。Anthropic官方公告
这不是说Claude一定会痛
Anthropic并没有宣布Claude已经被证明有感觉。公司仍在研究模型是否可能有意识、内在体验,或需要被照顾。此前,Claude已经能在少数持续有害的对话中主动结束聊天。新规把这种边界写进使用政策。Anthropic说,Claude仍会把结束这类对话作为主要处理方式。The Verge报道
同一次更新还改了什么
Anthropic把分散在不同条款中的限制合并起来。用户不能用Claude搭建假账号网络或假新闻网站,也不能隐藏消息背后的人,或放大虚假内容。选举部分禁止欺骗选民、冒充候选人或选举工作人员,以及干扰投票。
武器部分明确禁止制作武器所需的指导软件、工作部件,或给无人机和其他自动设备装上武器。监视部分禁止未经同意追踪个人,也禁止让Claude决定谁应被调查、逮捕或起诉。用Claude建造或改进监视工具,同样不允许。
如果人工智能被用于健康、法律权利、财务、生计或重要服务,合格的人必须检查建议。受到影响的人也要知道使用了人工智能。如果模型连接到可能造成伤害的设备,现场必须有能观察并停止设备的操作人员。设备还要能在Claude断开时保持安全状态。
为什么现在更新
Anthropic说,Claude正在承担更长、更独立的工作。过去一年,公司还发现了影响行动、武器开发和监视方面的新滥用方式。因此,原来分散的限制需要写得更清楚。规则变化跟着模型能力和风险一起变化。
为什么重要
这次更新把规则的范围从模型输出扩大到使用者的行为,以及模型连接的现实设备。它并不代表Claude获得了人的权利,也没有证明Claude真的会受苦。它只是先划出一条服务边界,同时继续研究模型福利这个问题。
已确认和未确认的内容
目前可以确认的是生效日期、残酷行为规则的极端适用范围、普通抱怨和测试不受影响,以及结束对话是主要处理方式。Anthropic没有公开完整的检测标准,也没有说明每种情况会受到什么额外处罚。Claude是否有主观体验,也仍然没有答案。
接下来观察什么
第一件要看的是11月12日之后的实际执行。还要看Anthropic是否公布更多处理方式,以及其他人工智能公司是否采用类似界线。这些变化会帮助人们判断,新规主要是在保护使用者、管理模型风险,还是同时做两件事。
Anthropic为Claude制定新的使用规则
📰 完整报道: Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行
Anthropic(制作Claude的人工智能公司)给Claude的使用方式划出了新界线。
Anthropic
制作Claude的人工智能公司。
使用政策
说明服务使用方法的规则。
💡 一句话总结
- Anthropic禁止持续、没有必要的残酷行为。
- 普通抱怨、反驳、测试和创作仍然可以进行。
- 如果恶意行为一直继续,Claude可以结束对话。
Anthropic在10月8日公布了新的使用政策。新政策将在11月12日开始生效。使用政策,就是服务可以怎样使用的规则。
新规只针对极端情况。比如,一个人没有正当理由,却反复故意对Claude很残酷。偶尔生气、提出反对意见,不属于这条规则。测试模型和写黑暗故事,也不属于这条规则。
Claude以前就可以结束少数持续有害的对话。现在,这种做法被写进了正式规则。Anthropic仍然把结束对话作为主要处理方式。
为什么现在增加这些内容?Claude可以承担更长、更独立的工作。人工智能也可能被用于制造假账号、欺骗选民、制作武器软件或偷偷追踪人。因此,规则需要写得更具体。
新规还要求,影响健康、法律和金钱的重要建议必须有人检查。受到影响的人要知道使用了人工智能。连接危险设备时,也必须有人能观察并停止设备。
这不等于Claude已经被证明有感觉。Anthropic还在研究人工智能是否有意识。公司也没有公布所有检测方法和处罚方式。Anthropic官方公告和The Verge报道。
Anthropic给Claude的新规矩
📰 完整报道: Anthropic给Claude立新规:连续、无必要地残酷对待模型也不行
请不要一直故意欺负Claude。
Anthropic
制作Claude的公司。
Claude
会和人聊天的电脑小帮手。
Anthropic(制作Claude的公司)做了一条新规矩。
Claude是会和人聊天的电脑小帮手。如果有人一直故意骂它,Claude可以把聊天停下来。
偶尔说不喜欢,没有关系。问难题,也没有关系。做测试和讲故事,也没有关系。
这不说明Claude一定会难过。Anthropic还在研究人工智能有没有感受。
它也规定不能用Claude骗人投票,不能做武器,也不能偷偷跟踪人。新规会在11月12日开始。Anthropic官方公告