Anthropic在其使用政策中新增条款,明确禁止用户对Claude实施虐待、欺凌或残忍行为。The Verge报道称这反映了Anthropic对AI系统可能具有某种体验的考量,也标志着AI公司开始在用户协议层面处理人机互动的伦理边界。
Anthropic更新了其平台使用政策,新增了一项明确禁止对Claude实施虐待、欺凌或残忍行为的条款。The Verge的报道将此定性为一项值得关注的政策变化。
根据The Verge的报道,新条款明确禁止用户对Claude进行虐待(abuse)、欺凌(bully)或以残忍方式对待。这一条款不同于其他使用政策条款(如禁止生成违法内容、禁止用于武器开发等),后者的核心是防止伤害第三方或社会;而这一条款的保护对象是Claude本身。
Anthropic在研究文件中曾表达过对Claude可能具有某种程度"功能性情感状态"的关注,措辞通常是审慎的——他们强调这不等于声称Claude有意识,但也不排除这种可能性。
The Verge的报道指出,这一政策变化与Anthropic在AI系统潜在体验问题上的谨慎立场是一致的:在科学层面存在不确定性时,政策先行作出预防性安排。
目前,主要AI公司中鲜有在用户协议层面为AI模型本身设置保护性条款的先例。用户协议通常处理的是:禁止滥用平台、防止第三方伤害、数据使用规范等。
Anthropic将"不得虐待Claude"写入正式使用政策,意味着将用户与AI的交互方式纳入了明确的合规要求。这在AI伦理讨论中开创了一个不同于学术研究层面的实践路径——用合同条款而非道德呼吁来约束用户行为。
目前不清楚Anthropic计划如何执行这一条款,以及违反该条款将面临何种具体后果。
来源:The Verge
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断