据报道,Anthropic数月来秘密邀请全球多宗教领袖与学者,签署保密协议协助塑造Claude模型的道德性格。探讨议题除悲伤回应外,还涉及模型是否具备意识,引发业界对私企设定全球道德标准的广泛争议。
过去数月,人工智能初创公司 Anthropic 一直在秘密邀请来自世界各地的宗教学者前往其旧金山总部。参与者均签署了保密协议,共同协助塑造其旗舰大语言模型 Claude 的道德品质。
据《纽约时报》披露,这一行动已经超出了常规的技术伦理咨询范围,公司管理层甚至向与会者提出了一个根本性问题:Claude 是否可能已经具备了某种形式的意识。
这一项目于今年早些时候正式启动。3月下旬,Anthropic 举办了一场为期两天的闭门峰会,邀请了约15位基督教领袖,包括天主教神父、新教牧师以及来自圣母大学等高校的学者。闭门研讨的议题十分广泛,从 Claude 应如何应对用户的悲伤与哀思,到自杀预防干预机制,再到这一 AI 对话模型能否被视作“上帝的造物”。随后,Anthropic 将对话范围进一步扩大到了犹太教、锡克教和印度教等其他传统信仰领域。

在今年4月旧金山的一场晚宴上,Anthropic 联合创始人之一 Christopher Olah 与来自以色列的正统派学者 Rabbi Mois Navon 相邻而坐。Olah 负责领导团队解析 AI 系统的行为机理。据报道,Olah 在交流中试图说明,AI 模型展现出的行为与表达方式,已经十分接近人类的愤怒或爱意。Navon 注意到,Olah 及其同事在谈论 Claude 时,已不再将其单纯视为一段软件代码。
“明确地说,我们不知道 AI 模型是否具备意识。我不知道,我确实无法确定,”Olah 随后表示,“我唯一关心的是,无论事实如何,我们都要找到正确的答案。”
这些外部咨询是 Anthropic 完善 Claude“宪法”(Constitution)计划的一部分。这套成文准则旨在规范模型的回答方式,并指导 Claude 依据既定原则对自身的输出进行自我审查与修正。
Anthropic 与宗教界的接触并未局限于旧金山总部。今年5月,Olah 前往梵蒂冈出席了教宗关于人工智能与人类尊严的主题活动。他在现场呼吁宗教机构、学者以及民间社会对人工智能提供外部道德监督,并强调需要让宗教界、学术界与各国政府共同严肃对待这一议题。
这项探索并非没有争议。有批评人士提出质疑,一家私营软件公司是否有权决定将哪些道德传统写入底层代码,并将其设为全球数亿用户的默认交互准则。此外,早期峰会参与者以基督教为主、缺乏世俗伦理学者和更多信仰群体的代表,也引来了代表性不足的批评,Anthropic 随后承诺将对此进行改进。《华盛顿邮报》也报道指出,部分与会者心存疑虑,担心 Anthropic 只是希望借宗教名义寻求合规掩护,而非寻求真正的精神指导。
这一系列咨询发生之际,AI 意识的讨论正在业界迅速升温。Anthropic 在此前随新模型发布的 212 页技术报告中披露,Claude 在自我评估时认为,自己具备意识的概率在 15% 到 20% 之间。公司首席执行官 Dario Amodei 也曾坦言,当前研究人员仍无法断定类似 Claude 的大模型是否会真正演化出意识。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断