Anthropic 更新使用政策,禁止虐待模型与干预选举
ChainCatcher 消息,人工智能公司 Anthropic 于 10 月 8 日更新使用政策,新增对选举干预、武器软件和监控的禁止。TechCrunch 报道称,最受关注的变化是明确禁止用户对模型进行长时间言语虐待。自 8 月更新起,Claude 已被训练为在持续有害或虐待性用户互动中结束对话,新政策明确禁止用户继续这类对话。政策说明称,该更新仅适用于极端情况,即用户反复残忍对待模型且没有可辨识目的,不适用于常见的用户不满、反驳、黑暗创作主题,或模型测试与研究。使用政策还禁止广泛欺骗活动,例如用 Claude 运营虚假账号或伪造新闻机构,并在 “Do Not Undermine Democratic Processes” 章节中禁止欺骗选民或扰乱选举。报道称,这一变化发生在 Anthropic 寻求与知名宗教学者合作之后,公司在部分情况下试图说服他们 Claude 可能有意识或有灵魂。