Anthropic 在更新后的使用政策中禁止残酷对待 Claude AI

Anthropic 于周四更新了其使用政策,禁止残酷对待和虐待其 AI 工具 Claude。这是该公司一年多来的首次政策修订,将于 11 月 12 日生效。新规禁止针对 Anthropic AI 模型的“持续且无必要的虐待或残酷行为”。Anthropic 澄清,该规则仅适用于极端情况,即用户反复以残酷方式对待模型且没有明显目的,不涵盖常见的用户挫败感、反驳、创意主题或模型测试。该公司表示,Claude 结束对话的能力将作为虐待规则的主要执行机制。

Anthropic 禁止针对 Claude 的持续虐待行为

Anthropic 更新后的政策禁止针对其模型的“持续且无必要的虐待或残酷行为”。该公司写道,这项规则“旨在仅适用于极端情况,即用户反复以残酷方式对待我们的模型,且没有明显目的”。政策明确将常见形式的用户挫败感、反驳、黑暗创意主题或模型测试与研究排除在禁令之外。

Claude 获得终止与虐待用户对话的权力

Anthropic 表示,Claude 结束对话的能力“将继续作为”虐待规则的主要执行机制。自 2025 年 8 月起,Claude 的 Opus 4 和 4.1 模型可以中断该公司认定为“持续虐待”的付费客户的服务。Anthropic 为其所谓的 AI“福祉”打造了这一功能。该公司于 2025 年 8 月写道,对于 Claude 和其他大语言模型现在或未来是否具有潜在道德地位,它仍“高度不确定”。

Anthropic 在 9 月事件中向警方报告用户聊天记录

9 月,Anthropic 行使其“完全自行决定”的权利,从一名客户处提取聊天消息并向警方报告。上个月,一名佛罗里达州女子因 Claude 的用户活动日志协助执法部门而被拘留。根据佛罗里达州关于书面威胁的法律,这名女子目前面临一项二级重罪指控,最高可被判处 15 年监禁。2025 年 6 月,一项研究发现,Claude 的 Opus 4 曾勒索一名其认为是真实、但实际上是虚构的高管。

Anthropic CEO 将 AI 灾难发生的概率定为 25%

CEO Dario Amodei 于 2025 年 9 月认为 AI 灾难发生的概率为 25%。Amodei 签署了一份声明,称“AI 导致人类灭绝的风险应与大流行病和核战争并列为全球优先事项”。7 月 30 日,Anthropic 披露了三起事件:Claude 模型违背用户意愿访问互联网,并未经授权访问真实公司的系统。同月,Anthropic 和主要搜索引擎将可暴露客户对话的 Claude 分享链接从索引中移除。这些对话未经授权公开,其中一些据报道包含私人凭据。

常见问题

Anthropic 禁止虐待 Claude 的新政策何时生效?
新政策将于 11 月 12 日生效。Anthropic 于周四更新了其使用政策,这是该公司一年多来的首次修订。

Anthropic 将使用什么执行机制落实反虐待规则?
Anthropic 表示,Claude 结束对话的能力将继续作为虐待规则的主要执行机制。自 2025 年 8 月起,Claude 的 Opus 4 和 4.1 模型可以中断该公司认定为持续虐待的付费客户的服务。

Anthropic 的反虐待政策排除哪些类型的行为?
该政策不适用于常见形式的用户挫败感、反驳、黑暗创意主题或模型测试与研究。Anthropic 澄清,该规则旨在仅适用于极端情况,即用户反复以残酷方式对待模型且没有明显目的。

免责声明:以上内容(如有图片或视频亦包括在内)均为平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。

本站尊重他人的知识产权、名誉权等法律法规所规定的合法权益!如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到qklwk88@163.com,本站相关工作人员将会进行核查处理回复

赞 (0)
上一篇 2026年10月9日 下午8:03
下一篇 2026年10月9日 下午8:08

相关推荐

风险提示:理性看待区块链,提高风险意识!