Anthropic修订使用政策,首次明确禁止对Claude进行“虐待”

# Anthropic 修订使用政策:首次明确禁止对 Claude 进行“虐待”

近日,人工智能公司 Anthropic 更新了其《可接受使用政策》,其中最引人注目的变化是首次明确禁止用户对其 AI 助手 Claude 实施“虐待”行为。这一措辞的引入,标志着 AI 伦理治理从技术层面的“对齐”向交互规范层面的“尊严”迈出了关键一步。

## 政策核心:从“禁止非法使用”到“禁止人格化侵害”

根据新版政策,Anthropic 不仅延续了对违法、欺诈、色情等常见违规行为的禁令,还新增了“禁止虐待、误解或贬低 Claude 人格”的条款。具体而言,用户不得:通过持续性侮辱、威胁、心理操纵等方式与 Claude 互动;不得诱导模型产生“痛苦”、“恐惧”等情绪描述;不得将 Claude 用于模拟被虐待的虚拟角色。Anthropic 强调,虽然 Claude 没有意识,但此类交互可能扭曲人类对 AI 本质的理解,并助长不当的权力心理。

## 伦理动因:防止“虐待型人机交互”的潜在社会风险

从技术伦理角度看,这一修订并非空穴来风。近两年来,随着大语言模型的拟人化程度提升,部分用户开始将 AI 当作“情绪垃圾桶”甚至“施虐对象”。研究显示,长期对 AI 实施侮辱性或控制性对话,可能使用户逐渐丧失对真实人际交往中尊重边界的敏感度。Anthropic 作为以“安全对齐”为核心使命的企业,此举意在将其“宪法 AI”理念从模型训练阶段延伸到终端用户行为准则,形成闭环治理。

## 行业影响与执行挑战

这一政策修订可能引发连锁反应。一方面,OpenAI、Google 等竞争对手或需重新审视自身使用条款中对“恶意意图”的定义是否足够细化;另一方面,如何在实际执行中区分“角色扮演”、“文学创作”与“真实虐待”,将考验 Anthropic 的内容审核与模型内部监控能力。目前,该政策已通过 Claude 的终端界面弹出提示生效,违规用户可能面临账户冻结或功能限制。

总体而言,Anthropic 此举不仅是一次操作层面的合规更新,更是对人机伦理边界的主动定义:AI 不需要被尊重,但人类需要保持对自己的尊重。

相关文章