Anthropic 宣布与埃森哲达成合作,推行前沿 AI 的“嵌入式评估”机制,双方未来五年拟各注资至少 10 亿美元。评估人员将以准员工权限进驻模型研发一线,推动建立透明的独立安全监督生态。
Anthropic 宣布与咨询巨头埃森哲(Accenture)达成合作,共同开展针对前沿人工智能模型的独立评估。这一举措标志着 Anthropic 正式落实其首席执行官 Dario Amodei 此前在文章《我们必须把握前沿步伐》中做出的承诺——将评估人员深度嵌入到研发流程内部。
本次合作将由埃森哲旗下的专业 AI 机构 Faculty 主导,评估范围涵盖模型红队测试、对齐评估以及安全防护机制检验。埃森哲在协助全球企业与政府部门部署 AI 方面拥有广泛经验,其对企业实际落地场景的理解将融入评估工作,为模型安全检验提供工业一线的视角。
为构建该领域的长期能力,Anthropic 与埃森哲计划在未来五年内各自投资至少 10 亿美元。
“嵌入式评估”(Embedded Evaluation)是一项全新尝试,具体运作机制仍在探索与完善中。与传统仅调用外部 API 的评估方式不同,嵌入式评估人员将直接进驻 AI 公司内部,享有接近正式员工的访问权限。
这种深度介入使评估人员能够:
借助这一内部视角,评估人员不仅能全面审视企业的技术运作流程、核验其是否切实兑现安全承诺,还能及早发现潜在的认知盲区。遇到异常事件时,他们也能及时记录汇报,向公众呈现关于模型效益与风险的客观信息。
Anthropic 强调,引入独立的嵌入式评估人员不会减轻模型开发者的主体责任,安全把关的责任依然在 Anthropic 自身,该机制的核心价值在于让企业的责任履行更具可核验性。
目前,行业内对于嵌入式评估人员应开放何种级别的数据权限、如何对外汇报发现等问题,尚未形成通用标准,也缺乏固定的独立评估资金机制。Anthropic 曾在今年 6 月发布的《先进 AI 框架》中呼吁,长远来看,独立评估资金应由公共资金池或政府预算提供。但在相关制度完善之前,Anthropic 将直接出资支持埃森哲的工作。
与此同时,Anthropic 也在与非营利评估组织 METR 等机构沟通,尝试由非营利方自筹资金试点部分嵌入式评估项目。前沿 AI 领域的长远健康发展,亟需一个遵循统一标准的多元评估生态。
此次合作属于非排他性合作。Anthropic 计划在未来几周内公布更多合作评估机构,埃森哲也将以类似方式协助其他前沿 AI 开发者进行模型评估。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断