快速了解本文
Anthropic 更新使用政策,明确禁止对 Claude 实施持续且无必要的虐待行为。
新政策大幅收紧高风险应用限制,涵盖选举干预及武器开发软件等领域。
针对虐待行为的执行机制仍以终止对话为主,未说明是否引入封禁措施。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 Anthropic 于 2026 年 10 月更新了其使用政策,这是该公司一年多来的首次政策调整。此次更新的核心亮点是明确禁止对 Claude 实施“持续且无必要的虐待或残忍行为”,同时针对选举干预、武器开发等高风险滥用场景大幅收紧了应用限制。
01界定“虐待”行为与执行机制
新政策中最受关注的条款是对 AI 模型交互行为的规范。Anthropic 规定,禁止用户反复对模型表现出残忍行为且无明显目的。该规定仅适用于极端情况,明确豁免了常见的用户挫败感、反驳、黑暗创作主题以及正常的模型测试与研究。
在处理机制上,终止对话仍是处理此类虐待行为的主要执行方式。去年 8 月,Anthropic 曾宣布允许 Claude 结束与“持续有害或虐待”用户的对话,但此次新政策并未说明是否会引入封禁用户等进一步的执行机制。
02收紧高风险领域应用红线
除模型交互规范外,新政策对商业与政治领域的高风险应用进行了严格限制。Anthropic 将多项分散的限制整合为新的禁令,禁止欺骗性的商业或政治宣传活动,并限制掩盖信息背后真实身份或通过假账号放大内容的行为。
在选举领域,政策明确禁止选民欺骗和选举破坏行为,包括传播关于候选人或投票方式的虚假信息、冒充候选人或选举官员,以及试图压制投票率。
此外,武器开发禁令的范围得到显著扩展。新政策将禁令延伸至“使武器运作的软件和组件,以及武装无人机和其他自主车辆等行为”,以应对试图利用 Claude 开发武器指导和控制软件的情况。
