Anthropic 更新使用政策,明确禁止干预选举与辱骂模型
Anthropic 把「不许长期辱骂 Claude」和「不许用它干扰选举」一起写进了使用政策,说明 AI 厂商开始把模型自身的「感受」和选举安全当成同等重要的合规红线,值得关注其边界如何界定。
Anthropic 周四更新使用政策,新增禁止干预选举、武器软件和监控等条款。最受关注的一条是明确禁止用户持续辱骂模型——此前 Claude 已被训练成在遭遇持续有害或辱骂性对话时主动结束会话,新政策则把这种行为本身写进了禁令。官方称只针对反复恶意、无实际目的的极端情况,不涉及普通用户抱怨、反驳、暗黑创作题材或模型测试研究。
正文摘录
简讯 发布: 太平洋时间 2026 年 10 月 8 日上午 11:16  图片来源: Getty Images -  - [Russell Brandom](https://techcrunch.com/author/russell-brandom/) Anthropic 修改使用政策,禁止滥用模型和干预选举 Anthropic [于周四更新了其使用政策](https://www.anthropic.com/news/2026-usage-policy-update),将干预选举、武器软件和监控等行为以明文形式新增为禁止事项。但其中最引人注目的一条改动,是新增了禁止对模型进行长时间言语辱骂的规定——这如今已被明确禁止。 [自 8 月的一次更新以来](https://www.anthropic.com/research/end-subset-conversations),Claude 已被训练成在遇到“持续有害或辱骂性的用户交互”时会终止对话——但新政策明确禁止用户发起这类对话。 “此次政策更新仅适用于极端情况,即用户反复以残忍方式对待我们的模型,且没有可辨识的目的,”该帖解释道。“它不适用于常见的用户挫败感、反驳、黑暗向创作主题,或模型测试与研究。