Anthropic 发布 2026 版使用政策更新,将于 11 月 12 日生效。针对 Claude 日益增强的自主智能体能力,新规全面收紧武器研发、无感监控与虚假宣传等滥用限制,并首次为具身硬件控制与极端虐待模型划定红线。
随着旗下大语言模型能力的持续演进,Anthropic 宣布对其产品使用政策进行全面年度更新。新版政策将于 11 月 12 日正式生效,重点针对 Claude 日益增强的长程处理能力和自主执行任务水平,进一步厘清各项规则边界。
Anthropic 指出,过去一年中 Claude 开始承担更长周期、更具独立性的复杂任务。结合此前在最新威胁情报报告中披露的影响力操纵、武器研发和非法监控等滥用态势,新政策补充了针对性规范,明确了医疗、金融等高风险场景的具体要求,并针对模型控制实体硬件以及恶意虐待模型的行为设立了专门条款。
Anthropic 在9月发布的威胁情报报告中曾披露,有国家媒体、宣传机构及商业实体利用 Claude 运营虚假账号矩阵及伪造新闻网站。尽管此前已有相关禁令,但条款分散在选举、欺诈、隐私与虚假信息等多个章节中。
新版政策将此类规则统一整合为“禁止参与欺诈性行动或人造虚假活动”专章,全面覆盖政治或商业领域的欺骗行为。无论是隐瞒信息幕后发布者、通过水军账号放大声量,还是构建影响力操纵的技术基础设施,均被列入明令禁止的范畴。
为确保模型在民主进程中得到合规使用,Anthropic 将选举相关条款重命名为“禁止破坏民主进程”。新规重点防范利用 Claude 欺骗选民或干扰选举秩序的行为,严禁散布候选人虚假信息、伪造投票流程、冒充公职人员或压制投票意愿。
与此同时,Anthropic 取消了对个性化选民触达的“一刀切”禁令。此前政策限制了合法公民服务的展开,例如非营利机构使用 Claude 为多语种选民编写指南,或选举官员发送选票修正通知等。但依赖欺骗手段或滥用选民个人数据的行为,依然受到欺诈与隐私条款的严格限制。
Anthropic 始终严禁利用 Claude 研发武器。针对近期出现的使用模型构建武器制导与控制软件的尝试,新政策明确界定:禁令不仅涵盖武器实体,还包括驱动武器运行的软件与核心组件,以及为无人机等自主设备加装武装的行为。
针对滥用 AI 建立监控系统、识别并追踪异见人士的风险,Anthropic 重新修订了监控与刑事司法条款。新规明确禁止在未经同意的情况下追踪个人(无论是实时追踪还是基于历史数据分析),禁止利用 Claude 决定或建议执法逮捕、调查对象,并禁止使用 Claude 开发或升级监控工具。
同时,新规也列出了允许的合规场景,包括经用户授权的活动(如欺诈交易监测)、内容审核、新闻采写以及法律学术研究。
在涉及个人健康、法律权益、财产与基本公共服务的高风险场景中,Anthropic 维持原有的合规要求:必须引入具备审核与修改权限的合格专业人员(人在回路),并明确告知受影响对象 AI 的介入。新版政策详细列出了受限与豁免的建议类型清单。
结合此前发布的模型硬件标准,政策新增了物理实体控制要求:当模型接入可能造成人身伤害的自主物理硬件时,现场必须配备有资质的操作员进行实时监督并具备紧急关停能力;同时,当 Claude 断开连接时,相关设备必须具备自动维持安全状态的能力。
新政策新增了禁止无故对模型实施持续性虐待或残忍行为的条款。该条款仅适用于无明确目的、反复对模型施加极端攻击的恶劣个案,不影响用户的正常情绪宣泄、质疑争辩、阴暗主题创作或模型安全对抗测试。
目前 Claude 已上线主动终止与持续恶意用户的对话功能,这一机制将作为主要执行手段。
继此前更新了支持地区政策后,Anthropic 在支持地区页面进一步厘清了执行细则:不仅物理位于非支持地区的人员以及在当地注册或设立总部的实体受到限制,凡由非支持地区主体持有多数股权或实际控制的企业,均在受限之列。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断