Anthropic 周四更新了其使用政策,正式写入对选举干预、武器软件和监控的新增禁令。不过,最引人关注的变化或许是新增了一项对模型进行长期言语辱骂的禁令,这一行为现在被明确禁止。
自 8 月的一次更新以来,Claude 一直被训练在面对“持续有害或辱骂性的用户互动”时结束对话——但新的政策明确禁止用户继续推进这类对话。
该帖子解释说:“这项政策更新只打算适用于极端情况,即用户反复以残酷方式对待我们的模型,且没有明显目的。它不适用于常见的用户不满、反驳、黑暗创意主题,或模型测试与研究。”
这一变化出现在 Anthropic 寻求与知名宗教学者合作之后——在某些情况下,公司试图说服他们,Claude 可能具有意识或灵魂。
使用政策的另一些条款禁止用户参与广泛的欺骗性活动,例如利用 Claude 运营虚假账号或伪造新闻机构。该政策还包含针对欺骗选民或扰乱选举的规则,相关内容被归入标题为“不要破坏民主进程”的章节。












