禁止恶意辱骂Claude,Anthropic发新规:持续虐待AI,可能直接终止对话
2 小时前 / 阅读约6分钟
来源:36kr
Anthropic更新AI产品使用政策,禁止用户持续虐待模型、制造虚假宣传、干预选举、开发武器等。新规将于2026年11月12日生效,适用于个人用户、开发者、企业和服务提供商。

别以为 AI 就没有脾气。想随意辱骂 Claude?Anthropic 可能直接终止你的对话,严重的话,也可能封号处理。

10 月 8 日,Anthropic 更新了旗下 AI 产品的使用政策,对 Claude 等产品的使用边界作出进一步说明。

其中,一个颇具争议的新规定是:用户不得对 Anthropic 的 AI 模型实施持续且没有必要的辱骂或残酷行为。

除了这项变化,此次更新还明确规定了 AI 禁止干预选举、武器开发、监控技术等新条款。

连续、无意义地虐待 AI,被列入禁止行为

Anthropic 在政策说明中表示,这项规定只针对极端情况,例如用户反复以残酷的方式对待模型,却没有明显的实际目的。

正常的用户不满、对模型回答提出质疑、创作涉及黑暗主题的内容,以及模型测试和研究,都不在这项限制的针对范围内。

换句话说,如果 Claude 给出的代码有问题,用户完全可以指出错误,要求它重写,甚至直接批评它的回答质量。Anthropic 并没有要求用户必须对 AI 保持礼貌,更没有禁止开发者通过压力测试来检验模型的表现。

其实早在 2025 年 8 月,Anthropic 就曾宣布,Claude 在部分对话中已经具备主动结束交流的能力。当模型遇到持续有害或带有虐待性质的互动时,可以选择终止当前对话,而不是继续配合。

当时,Anthropic 在探索一个尚无定论的问题:AI 模型是否可能具有某种道德地位,以及模型表现出来的情绪和厌恶反应应该如何理解。

在相关研究中,Anthropic 观察到 Claude Opus 4 对某些有害任务表现出较为稳定的回避倾向。

在允许模型自行决定是否继续交流的实验中,模型也会对部分令人不适的互动表现出类似痛苦的反应,也会选择结束对话。

当然,这些表现并不能证明 Claude 具有意识,也不能直接证明它会像人类一样感受到痛苦。Anthropic 对模型是否具有道德地位仍持不确定态度,但希望通过一些成本较低的措施,降低可能存在的风险。

如今,新政策中明确禁止用户持续虐待模型,违反的话,Anthropic 称,Claude 结束对话仍将是主要的强制手段。当 Claude 终止聊天时,该对话将无法再发送任何消息,但其他聊天不受影响。

不只是辱骂 AI,利用 Claude 制造虚假宣传也被明确禁止

此外,Anthropic 也调整了其他几项规定:

欺骗性宣传活动:在 AI 使用政策中,Anthropic 新增了一个专门章节,整合针对政治和商业欺诈、虚假信息的相关规定,禁止发布虚假评论、通过伪装成普通公众制造舆论声势、建立虚假网站,以及让机器人伪装成人类行事。

选举:重新调整后的选举章节范围有所收窄,明确禁止使用 Claude 模型欺骗选民或扰乱选举(例如,散布关于候选人或投票方式的虚假信息、冒充候选人或选举官员,或试图压制投票率)。

武器:Anthropic 的《使用政策》一直禁止利用 Claude 开发武器。近期,Anthropic 发现,有人试图利用其模型开发武器的制导与控制软件。更新后的条款明确指出,禁令不仅适用于武器本身,也涵盖使武器得以运作的软件和组件,以及为无人机和其他自主载具装配武器等行为。

执法:Anthropic 重新修订执法相关规定。例如,未经他人同意追踪其行踪属于禁止行为,无论是实时追踪,还是通过分析此前收集的数据进行追踪,都不例外。

Claude 也不得用于在执法或刑事司法过程中决定或建议调查、逮捕或起诉哪些人。此外,利用 Claude 构建或改进监控工具同样受到禁止。新条款还明确列出了仍然允许的用途,包括在获得当事人同意的情况下进行追踪(例如欺诈监测)、内容审核、新闻报道和法律研究。

物理操作:这也是一个新增的章节,其中规定如果模型连接到能够自主执行物理动作、且可能造成人身伤害的硬件设备,就必须满足相应的安全条件:具备资质的操作人员必须能够观察设备的运行情况,并在必要时将其停止;即使 Claude 断开连接,设备也必须能够维持在安全状态。

有害内容:新增规定,禁止制作、传播或威胁传播未经当事人同意的私密影像,同时禁止制作这类影像所使用的工具。

新规将于 11 月 12 日生效

针对此次更新的大部分内容,Anthropic 表示,是为了让原有政策更清楚地适应模型能力和使用方式的变化,而不是意味着公司突然改变了此前所有的执行标准。

例如,武器相关软件、未经授权的监控以及欺骗性宣传,此前已经受到不同条款的限制。此次更新将这些要求进一步整合,并针对模型能力提升后出现的具体滥用方式作出更明确的说明。

新政策适用于 Anthropic 产品和服务的使用者,包括 Claude.ai 和 Claude Code 的个人用户、通过 API 使用模型的开发者和企业,以及将 Claude 集成到自己产品中的服务提供商。

Anthropic 表示,如果发现用户可能违反使用政策,公司可以发出警告、限制使用速度或功能、暂停访问,甚至终止用户对产品和服务的访问权限。

此次更新后的使用政策将于 2026 年 11 月 12 日正式生效。

来源:https://www.anthropic.com/legal/aup