Anthropic修订Claude政策 禁止虐待AI模型
AI摘要
由 AI 生成 · 仅供参考
Anthropic 修订 Claude 使用政策,将于 2026 年 11 月 12 日生效,首次加入禁止持续且不必要的虐待或残忍行为条款,并扩大武器、监控及自主硬件安全规则,以约束模型高风险使用场景。
驱动中国10月9日消息,Anthropic 修订 Claude 使用政策,首次加入禁止“持续且不必要的虐待或残忍行为”条款,相关规则将于 2026 年 11 月 12 日生效。
The Verge 发布博文称,此次修订针对用户反复、无明显目的地对模型实施残忍行为的情况,将上述行为纳入禁止范围。
在执行机制上,Anthropic 表示主要处理方式为终止对话,但未明确是否会引入用户封禁等进一步措施。公司同时强调,该条款不适用于常见抱怨、质疑、黑暗创作主题以及模型测试与研究。
除虐待模型相关条款外,Anthropic 扩大武器禁令范围,涵盖使武器运转的软件与组件,以及武装无人机和其他自主车辆等行为。公司称已发现多起利用 Claude 开发武器指导或控制软件的尝试。
监控条款明确禁止未经同意追踪个人,无论实时追踪还是分析既有数据。Claude 不得用于决定或建议执法与刑事司法程序中的调查、逮捕或起诉对象,也不得用于构建或改进监控工具。
当 AI 连接至可能造成伤害的自主物理硬件时,Anthropic 规定必须由合格操作者观察设备,并在必要时停止。对于特定政府客户,公司可在合同限制与安全措施充分时调整规则。
版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系
editor@qudong.com。
来源:驱动中国 · 原文链接:https://www.qudong.com/article/525689.html
本文价值
★★★★★
5
1 人已评
登录后为本文打分
评论加载中…