知名人工智能企业 Anthropic 近日对旗下 AI 助手 Claude 的使用政策进行了全面修订,新规定将于2026年11月12日正式生效。此次修订最引人关注的变化之一,便是首次在条款中加入了禁止“持续且不必要的虐待或残忍行为”的明确限制。

根据官方说明,该规则主要针对用户在没有明确目的、反复对模型实施残忍对待的情况。在具体的执行机制上,Anthropic 表示目前的处理方式主要为终止对话,不过尚未明确未来是否会引入封禁用户账号等更进一步的惩罚措施。同时,公司特别强调,这一条款并不适用于用户日常的抱怨、质疑、含有黑暗主题的文学创作,以及合规的模型安全测试与研究。

除了规范人机交互行为,Anthropic 还对多项核心领域的禁令进行了扩容与细化:

武器禁令升级:进一步扩大了武器相关禁令的适用范围,明确涵盖使武器正常运转的软件与组件,以及武装无人机和其他自主车辆的开发行为。Anthropic 透露,此前已经发现多起试图利用 Claude 开发武器指导或控制软件的违规尝试。

强化监控限制:在监控条款中明确禁止未经同意追踪个人的行为,无论是实时追踪还是分析既有数据均在禁令之列。同时,严禁将 Claude 用于决定或建议执法与刑事司法程序中的调查、逮捕或起诉对象,也不得用于构建或改进任何监控工具。

物理硬件安全:规定当 AI 连接至可能对外界造成伤害的自主物理硬件时,必须有合格的操作人员在现场进行观察,并在必要时能够随时停止设备运行。不过,针对特定的政府客户,Anthropic 表示如果在合同限制和安全防护措施充分的前提下,可以对相关规则进行灵活调整。