Anthropic选择埃森哲进行第三方AI安全评估
4 小时前 1 阅读来源:engadget.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
Anthropic 把 AI 安全评估外包给了埃森哲,双方各掏10亿美元
AI 安全领域出现了一种新玩法。Anthropic 宣布与全球咨询巨头埃森哲达成合作,由埃森哲派驻评估团队常驻 Anthropic 内部,对其前沿 AI 模型进行第三方安全合规审查。双方将在未来五年内各自投入至少10亿美元(约合人民币72亿元)用于这项联合计划。这是 Anthropic CEO 达里奥·阿莫代伊提出的“放缓 AI 开发节奏”方案落地后的第一个实质性动作。
阿莫代伊上周公布了一套三步走方案,核心主张是:所有从事“前沿 AI”开发的公司都应当允许第三方评估人员以“类似员工的身份”常驻公司内部,持续监督安全承诺是否被遵守、上报安全事故、评估模型对齐情况。埃森哲的评估人员将具体做三件事:观察模型在训练过程中如何成型,追踪模型构建和部署的决策链路,以及直接与 Anthropic 员工对话。Anthropic 解释选择埃森哲的原因时提到,后者在帮助企业和政府跨行业部署 AI 方面有丰富经验,对“企业到底怎么用 AI”有实际认知,能为 Anthropic 提供更多外部视角。
不过 Anthropic 也坦承,这种“嵌入式评估”模式是全新事物,目前连评估范围、评估人员能获得多大权限、发现问题后按什么流程上报都还没有既定标准。为此,Anthropic 表示除了埃森哲之外,还将在未来几周内公布更多第三方评估机构。同时,埃森哲也不会只为 Anthropic 一家服务,它将与其他 AI 公司展开类似合作。这意味着“第三方常驻评估”有可能从一家公司的内部实验,演变为整个 AI 行业的安全治理范式。对 AI 从业者来说,这释放了一个明确信号:前沿模型的开发透明度正在从“自愿公开”走向“强制在场”,未来 AI 公司的安全团队里出现外部面孔,可能不再是新闻。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
