扩展网络验证计划 - Anthropic
1 天前 5 阅读来源:anthropic.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
Anthropic 正在把网络安全能力开放给更多防御方。这家 AI 公司于 10 月 6 日宣布,将原有的两项安全准入计划整合并升级为新的网络安全验证计划(Cyber Verification Program,简称 CVP),首次设立三个分级访问层,让经过审核的安全团队能够使用其最强模型,并减少原本用于拦截网络相关请求的安全分类器限制。三个层级覆盖的模型包括 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1,以及未来发布的新模型。
这件事的背景在于,网络安全能力天然具有双重用途。同一套发现并修复漏洞的技术,落到恶意攻击者手里就能变成入侵工具。正因如此,Anthropic 面向普通用户开放的模型都带有保守的网络安全防护机制,会拦截大部分网络相关操作,目的是压缩恶意行为者的作恶空间,代价则是安全团队在做正当防御时也频繁遭遇误判。过去半年,Anthropic 通过 Project Glasswing 和 CVP 两个项目向受信任机构开放权限:前者让负责关键软件安全的组织使用 Claude Mythos,后者让通过审查的安全团队在 Opus 和 Sonnet 模型上获得更宽松的限制。此次整合,就是要把这套受控访问机制规模化,覆盖更多防御型安全组织。
三个层级按工作范围划分,审核要求和安全控制各不相同。Defense Access 面向防御性工作,包括安全运营中心与事件响应、恶意软件逆向工程、漏洞分析与验证,企业、非营利组织、高校、政府机构的安全团队,以及关键基础设施运营方(如地区医院、市政公用事业)、中小安全公司、开源维护者和有漏洞报告记录的个人研究者均可申请,官方预计多数从事防御性网络安全工作的组织都能通过,审核周期为几天。Red Team Access 在防御用途之上增加了授权渗透测试和红队演练,申请方包括企业内部红队、政府红队和安全测试公司,但只能对获得授权的系统进行对抗性测试,涉及部署勒索软件、破坏物理系统、对高风险安全系统做渗透等可能造成人身伤害或大规模中断的操作仍会被实时拦截,审核周期预计数周,且目前仅限机构申请,个人研究者不符合资格。Specialized Access 的网络安全拦截最少,仅保留给少数经深度审核的机构,用于测试可能影响人身安全或市场稳定的系统,例如飞行操作系统、电网、电信网络、银行间转账基础设施和政府行政网络。
对出海企业和 AI 从业者来说,这一变化释放了两个信号。一方面,AI 厂商正在把安全能力从一刀切拦截转向分级授权,谁能拿到最强模型和最低限制,取决于身份验证和使用场景审核,这意味着安全团队未来在采购 AI 工具时需要准备更完整的资质材料。另一方面,Anthropic 明确把关键基础设施和金融、电信系统单独划为最高层级,说明前沿模型在敏感领域的落地仍将走深度人工审核路线,短期内不会对普通开发者开放。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
