据 Engadget 报道,Anthropic 于 9 月 19 日宣布选择埃森哲(Accenture)担任其前沿 AI 模型的第三方安全评估方,埃森哲的评估人员将嵌入 Anthropic 内部。Anthropic 表示,这是其首席执行官达里奥·阿莫代伊(Dario Amodei)上周提出的放缓 AI 开发节奏计划的第一步。

埃森哲此前的业务以咨询为主,此次将其服务范围扩展至评估 Anthropic 前沿 AI 模型的安全合规情况。按照双方公布的合作安排,未来五年内,两家公司将各自向这一联合项目投入至少 10 亿美元。

阿莫代伊上周提出了一套三步方案,主张所有“前沿 AI”公司向嵌入式第三方评估人员提供“持续、类似员工”的访问权限,由后者确保公司的安全实践与承诺得到遵守、报告发生的事件,并评估 AI 模型的对齐情况。Anthropic 在说明中称,埃森哲的评估人员将“观察模型在训练过程中成形、跟踪决定这些模型如何构建和部署的决策,并直接与员工交谈”。

Anthropic 解释选择埃森哲的原因时说,后者有帮助企业及政府在各行业部署 AI 的经验,也了解企业如何使用 AI,因而能够就 Anthropic 自身的模型提供更多视角。

Anthropic 同时表示,嵌入式评估人员的做法尚属新事物,目前在评估范围、评估人员可获得何种访问权限,以及报告关切问题的程序等方面都还没有既定标准。

除埃森哲之外,Anthropic 还将与其他公司合作评估其前沿 AI 模型,并称将在未来几周公布其他评估方。埃森哲也将与 Anthropic 以外的 AI 公司开展同类合作。