Anthropic时隔一年多更新使用政策,新增禁止对Claude进行持续且无端虐待行为的条款,并在极端情况下允许模型主动中断对话。更新还细化了武器研发、监视及虚假宣传的限制,并规范了硬件控制场景。
Anthropic 发布了最新版使用政策。这是该公司一年多来首次修订该规则,新增了一条禁止对旗下 Claude 模型实施“持续且无端的虐待或残酷行为”的条款。新政策还系统整合了针对欺骗性活动的限制,并进一步明确定性了违规的武器和监控用途。
Anthropic 表示,大多数修改旨在明确既有规则。本次修订反映了过去一年中 Claude 承担了更长周期、更独立任务的实际变化,同时也结合了客户反馈及 9 月威胁情报报告中总结的滥用模式。

Anthropic 强调,反虐待条款“仅适用于极端情况,即用户在没有明确目的的前提下反复残酷对待模型”。该规则不适用于普通的用户情绪挫败、反驳、黑暗风格的创意写作,或模型测试与学术研究。
这一规则的主要执行手段依托于此前上线的功能:面对持续言语虐待的用户,Claude 可以主动终止对话。Anthropic 将该功能作为其“模型福利”(model welfare)研究的一部分进行开发。据 The Verge 报道,公司尚未说明是否会采取封号等其他惩罚措施。
此项调整的背景在于 Anthropic 持续探索模型是否具备某种内心体验。CEO Dario Amodei 曾在播客中表示:“我们不知道模型是否具备意识。”其他同行对此持不同意见,微软 AI 负责人 Mustafa Suleyman 在 9 月公布的一份行为准则草案中曾直言:“模型福利的概念是错误的。”
新版政策新增了名为“不得从事欺骗性活动或人为操纵行为”的独立板块,整合了以往分散的条款。该部分涵盖隐瞒信息发布者真实身份、通过虚假账号刷量扩散内容,以及构建用于影响力行动的工具等行为。Anthropic 指出,已有官方媒体机构、政府宣传部门及商业公司尝试利用 Claude 运营此类网络。
与此同时,Anthropic 取消了此前对个性化选民定向的全面禁令,原因是该限制曾阻碍了选民信息翻译等合规的公共服务工作。
在武器方面,限制范围扩展到“支持武器运行的软件和组件”,包括无人机及其他自主车辆的武器化改装。Anthropic 表示,已观察到有人试图利用 Claude 编写武器制导与控制软件的案例。政策还明令禁止未经许可跟踪个人,以及使用 Claude 协助决定或建议对特定人员展开调查、逮捕或起诉。
新政策还对连接实体硬件的模型提出了要求。当 Claude 连接到可能造成人身伤害、且能自主做出物理动作的设备时,必须满足监管条件:“具备资质的人员必须能够监控设备,并在必要时立即叫停”,同时在 Claude 出现异常时设备必须能保持在安全状态。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断