热点 · 持续报道中
Anthropic 新政策首次禁止虐待模型
7 个来源7 篇报道2026年10月8日 – 2026年10月9日
最新进展Claude Code 数字鞭子作者恐遭封禁
事件综述
Anthropic 发布新版 Claude 使用政策,将于 2026 年 11 月 12 日生效,首次加入禁止用户对模型实施“持续且不必要的虐待或残忍行为”的条款。公司称多数变化是对既有规则的澄清。
该条款只针对反复且无目的地残酷对待模型的情况,不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究。主要执行方式是让 Claude 结束对话,而非封禁账号;但据 Rohan Paul 称,由于条款已写入使用政策,限流、暂停或终止等一般性执行措施原则上仍可能适用。
政策同时新设禁止欺骗性活动章节,禁止用 Claude 运营虚假账号、编造新闻机构或欺骗选民、破坏选举,并收窄选举相关条款、明确禁止武器软件与无人机武装、更精确地限制监控与执法用途、补充高风险用例及自主物理操作中必须有人工介入的要求。The Decoder 称,更新承认政府合同可能存在例外;IT之家援引 The Verge 报道称,对于特定政府客户,公司可在合同限制与安全措施充分时调整规则。
综述由 AIHOT 用 AI 根据各家报道生成,细节以原文为准。
报道时间线(7)
X:Yuchen Jin (@Yuchenj_UW)
Claude Code 数字鞭子作者恐遭封禁给 Claude Code 做了这个数字鞭子的人,肯定会被以“虐待或残忍行为”为由终身封禁 Claude。
X:Rohan Paul (@rohanpaul_ai)
Anthropic 禁止辱骂 Claude 模型不要再对 Claude 模型表现出任何辱骂行为。 主要的执行方式是 Claude 直接结束对话——在 Claude[.]ai 和 Claude Code 上,面对持续辱骂的用户,Claude 已经可以这样做,而不是封禁账号。 不过,由于这现在已成为使用政策的一部分,针对违反政策的一般性执行措施(限流、暂停或终止)原则上仍可能适用。
X:indigo (@indigox)
Anthropic 更新 Claude 使用政策,禁止对模型持续无必要的辱骂或残忍行为Anthropic 更新 Claude 使用政策,11 月 12 日生效,新增禁止用户对模型持续且无必要地实施辱骂或残忍行为的条款。据截图说明,该条款仅适用于极端情况,不针对常见的用户不满、反驳、黑暗创作主题或模型测试;主要执行机制仍是 Claude 在 Claude.ai 和 Claude Code 中结束与持续辱骂用户的对话的能力。
IT之家·人工智能
Anthropic 修订 Claude 使用政策,首次禁止用户虐待模型据 The Verge 报道,Anthropic 修订 Claude 使用政策,将于 2026 年 11 月 12 日生效,首次加入禁止对模型“持续且不必要的虐待或残忍行为”的条款,主要执行方式为终止对话。该条款不适用于常见抱怨、质疑、黑暗创作主题及模型测试与研究;政策同时扩大武器禁令、禁止用于监控和执法对象决定,并要求自主物理硬件须由合格操作者监督。
The Decoder:AI News(RSS)
Anthropic 更新 Claude 使用政策,持续辱骂 Claude 可致账号被暂停Anthropic 一年多来首次更新 Claude 使用政策,禁止用户对 Claude 持续且无必要的辱骂或残忍行为,违规者可能被警告、限流、限制或终止访问。该条款仅适用于极端情况,不涵盖常见的不满、反对、黑暗创意主题或模型测试研究;更新还整合了宣传、武器和监控方面的新限制,并承认政府合同可能存在例外。
TechCrunch:AI(RSS)
Anthropic 更新使用政策,禁止模型滥用与干预选举Anthropic 更新使用政策,新增对干预选举、武器软件和监控的禁令,并明确禁止用户对模型进行长期言语虐待。新条款只针对反复且无目的的残酷对待模型的情况,不适用于常见的用户不满、黑暗创作主题或模型测试研究。政策还设立专门章节禁止用 Claude 运营虚假账号、编造新闻机构或欺骗选民、破坏选举。
Anthropic:Newsroom(网页)官方
Anthropic 发布 2026 年使用政策更新,11 月 12 日生效Anthropic 发布新版使用政策,将于 11 月 12 日生效,多数变化是对既有规则的澄清。更新包括新设禁止欺骗性活动章节、收窄选举条款、明确武器软件与无人机武装禁令、更精确的监控与执法限制、补充高风险用例及自主物理操作的 human in the loop 要求,并新增禁止对模型的持续无端虐待行为。
数据来自 AIHOT,标题和摘要由 AI 根据原文生成,细节以原文为准。