AI工具AI评分 一般 (51)AI 中文改写

杰弗里·辛顿与AI监管机构敦促OpenAI、Anthropic制定安全计划

16 小时前 1 阅读来源:businessinsider.com

AI 中文改写

原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接

AI教父杰弗里·辛顿联合多家监督机构,向OpenAI和Anthropic提出了一份“最低条件”清单,要求这两家头部AI实验室在接受第三方风险评估时,必须给予评估者真正的独立性和透明度。这封于周五发布的公开信由AI评估者论坛牵头,签署者包括辛顿和斯图尔特·拉塞尔等计算机科学领域的先驱人物,以及数十位来自AI生态系统的从业者。 事情的起因是,Anthropic CEO达里奥·阿莫代伊和OpenAI CEO山姆·奥特曼本周先后承诺,将欢迎第三方评估人员入驻公司内部,对AI风险进行审查,并给予他们员工级别的信息访问权限。这一表态的背景是本周网络上对AI相关风险的担忧情绪集中爆发。但监督机构显然不满足于口头承诺,而是希望把“欢迎”变成有约束力的制度安排。 公开信明确指出,要让嵌入式第三方评估者真正可信,他们必须具备科学客观性、透明度、独立性,以及免受被评估公司干扰的强有力保护。具体来说,评估者应当能够与公司董事会及其他特权监督机构进行不受过滤的沟通,并有权公开披露评估发现。同时,这些评估者不能因为说了真话而遭到AI实验室的打击报复,他们应当获得与公司内部评估人员“同等的相关系统、数据、工具和物理空间”访问权限。信中还说,每家实验室引入的评估者应涵盖“不同观点和专业领域”,包括生物科学风险和失控风险等不同类型的风险方向。 这封公开信背后的AI评估者论坛,成员包括非营利AI评估机构METR——该机构最近调查了OpenAI与Hugging Face之间的安全事件——以及由前OpenAI员工迈尔斯·布伦戴奇领导的AI验证与评估研究所(AVERI)等组织。值得注意的是,微软CEO萨蒂亚·纳德拉本周也表态称,微软欢迎“嵌入式评估者”这一思路,说明这场关于AI安全治理的讨论正在从监督机构向科技巨头内部蔓延。对于关注AI治理走向的从业者来说,这封信的意义在于:它把“第三方评估”从一句公关话术,推向了具体的操作标准和权力边界问题——评估者到底能看什么、能说什么、受什么保护,这些才是决定AI安全承诺是否可信的关键。

以上为 AI 中文改写版本,如需查看英文原文请访问

英文原文 · businessinsider.com

内容版权归原作者及 businessinsider.com 所有

这篇文章对你有帮助吗?
觉得有用?分享给更多人

留言 · 0

暂无留言,来说两句吧

留言经合规过滤后展示,禁止违法内容