Claude 新规 11 月 12 日生效:首次禁止"虐待 AI",武器、监控、硬件管得更严

骂 AI 也要有度了?Anthropic 修订使用政策,首次写入"禁止残忍对待模型"

正文

摘要:Anthropic 全面修订了 Claude 的使用政策,新规将于 2026 年 11 月 12 日生效。最受关注的是首次加入"禁止持续且不必要的虐待或残忍行为",违规目前的处理方式是终止对话。此外,武器禁令扩大到相关软件、组件和武装无人机等自主车辆;监控条款明确禁止未经同意的追踪,并限制用于执法和刑事司法决策;AI 连接可能造成伤害的自主硬件时,必须有合格人员在场监督并能随时叫停。日常正常使用基本不受影响。

Anthropic 近日对旗下 AI 助手 Claude 的使用政策做了一次全面修订,新规定将于 2026 年 11 月 12 日正式生效。这次改动里,最引人注意的是条款中首次出现了"禁止持续且不必要的虐待或残忍行为"。除此之外,武器、监控、物理硬件三个高风险领域的规则也被扩容和细化。

一、首次写入:不准"持续且不必要"地虐待模型

这条规则针对的是没有明确目的、反复对模型实施残忍对待的情况。关键在"持续"和"不必要"两个词,偶尔发泄一下不算,毫无目的地反复折磨才算。

执行上,Anthropic 目前的处理方式是终止对话。至于以后会不会引入封禁账号等更重的措施,官方还没有明确表态。

公司同时强调,下面这些情况不受这条限制:

  • 用户日常的抱怨、对模型表达不满
  • 对模型的质疑
  • 含有黑暗主题的文学创作
  • 合规的模型安全测试与研究

也就是说,正常使用、吐槽两句、写黑暗题材小说、做安全测试,都不会被误伤。

二、武器禁令:从"武器本身"扩到"让武器运转的东西"

新规进一步扩大了武器相关禁令的适用范围,明确涵盖:

  • 使武器正常运转的软件与组件
  • 武装无人机和其他自主车辆的开发

Anthropic 透露,此前已经发现多起有人试图利用 Claude 开发武器指导或控制软件,这次修订有明显的针对性。

三、监控限制:不准偷偷追踪,也不准参与执法决策

监控条款这次写得更具体,主要有三点:

  • 禁止未经同意追踪个人,无论是实时追踪,还是分析已有数据,都在禁止之列
  • 禁止用 Claude 决定或建议执法与刑事司法程序中的调查、逮捕或起诉对象
  • 禁止用 Claude 构建或改进任何监控工具

四、物理硬件安全:AI 控制设备,必须有人盯着

当 Claude 连接到可能对外界造成伤害的自主物理硬件时,新规要求必须有合格的操作人员在现场观察,并且能在必要时随时停止设备运行。

不过对于特定的政府客户,Anthropic 表示,只要合同限制和安全防护措施充分,可以对相关规则灵活调整。

五、谁会受影响

整体看,这次修订有两个方向:一是开始对用户与模型之间的互动方式提出要求,二是在武器、监控、实体设备等高风险领域把边界划得更清楚。

对普通用户来说,日常提问、写作、编程、吐槽都不会有变化。真正受影响的,主要是做武器相关开发、监控类产品,以及让 AI 控制实体设备的团队。新规生效前,相关从业者最好对照新条款检查一下自己的使用场景。

上一篇 / 下一篇

上一篇:对话即可生成剧情,剪映把互动影游的门槛又降了一截

下一篇:长文本为何时好时坏?字节 Seed 揭秘:压缩 KV 缓存带来"相位敏感性",检