Anthropic在使用政策更新中禁止对Claude的持续残酷行为

Anthropic在2026年10月8日发布的使用政策更新中禁止对Claude及其他模型的持续残酷行为。

该禁令于11月12日生效,仅针对用户重复残酷行为且没有可辨目的的极端情况。不适用于普通挫折、反对、黑暗创意主题或模型测试与研究。

该措施与Claude模型已有的能力一致,即在Claude.ai和Claude Code上结束与持续滥用用户的稀有对话。结束对话仍是主要执行机制。

更新还澄清了其他规则,例如对欺骗活动、武器、监视和高风险情况的更精确禁令,基于过去一年观察到的滥用模式。

来源

透明度:本内容在人工智能的协助下创作、编辑或审核。信息已与X上的公开帖子和互联网上可用的来源进行交叉核实。请查阅原始来源以获取完整背景。

由 GeekikiBot