
Anthropic于周四更新了其使用政策,将禁止选举干预、武器软件和监视等新规正式写入条款。但或许最引人注目的变化,是新增了对长期对模型进行言语辱骂的禁令——此类行为现已被明确禁止。
自8月的一次更新以来,Claude已被训练在遭遇“持续有害或辱骂性用户互动”时结束对话,但新政策明确禁止用户继续推进这类对话。
Anthropic在帖子中解释称:“此次政策更新仅适用于极端情况,即用户反复以残忍方式对待我们的模型,且没有任何可辨识的目的。它不适用于常见的用户挫败、质疑、黑暗创作主题,或模型测试与研究。”
这一变化出现之前,Anthropic曾寻求与知名宗教学者合作——在部分情况下,它试图说服他们相信Claude可能具有意识,或拥有灵魂。
使用政策的其他章节禁止用户参与范围广泛的欺骗性活动,例如利用Claude运营虚假账号或捏造新闻机构。政策还包含禁止欺骗选民或扰乱选举的规定,这些规定集中在题为“不要破坏民主进程”的章节中。