返回行业动态
企业AI落地

Anthropic 把网络验证计划扩为三档:向防御方开放更少护栏的 Claude

10 月 6 日,Anthropic 把 Project Glasswing 与原网络验证计划合并为三档的扩展版 CVP,经审核的安全从业者可按资质获得更强网络能力与更少阻断的分类器,各档均含 Claude Opus 5.5、Sonnet 5.5 与 Mythos 5.1。官方称 Glasswing 合作方 4 至 7 月发现至少 12.9 万个已验证漏洞,其中逾 3.3 万个为严重或高危;自建评测显示 Defense 档拦下 50 次试验中的 46 次。

来源:Anthropic 官方公告:Expanding the Cyber Verification Program原标题:Expanding the Cyber Verification Program查看原文
深色安全运营中心中悬浮的三层同心发光圆环,最内层为银色盾牌轮廓

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

10 月 6 日,Anthropic 宣布把过去半年并行运行的两个计划——Project Glasswing 与原有的网络验证计划(CVP)——合并为一个扩展版 CVP,向通过审核的安全从业者开放更强的网络能力与更少阻断的分类器。新计划分为三档,每一档都可访问 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 及今后的新模型。

  • Defense 档:面向防御性工作,包括安全运营中心、事件响应、恶意软件逆向与漏洞分析验证。可申请主体覆盖企业、非营利组织、高校与政府机构的安全团队,任何规模的关键基础设施运营方(如地区医院、市政公用事业),小型安全公司、开源维护者,以及有漏洞上报记录的独立研究者。官方目标为数天内答复
  • Red Team 档:在防御用途之上增加授权渗透测试与红队演练,仅限组织申请。仍保留对勒索软件部署、破坏物理系统、渗透测试高风险安全系统等行为的实时阻断,审核需数周;审核期间申请方先被纳入 Defense 档
  • Specialized 档:阻断最少,仅面向少数经审核、获授权测试飞行操作系统、电网、电信网络、银行间转账基础设施与政府行政网络的组织。Anthropic 目前逐一与美国政府联合审查,原有 Glasswing 成员直接转入该档
  • 申请规则:个人只能申请 Defense 档且需付费订阅;每个组织提交单一申请,Anthropic 将其放到材料支持的最高档位,并按要求核验安全控制措施
  • 资格考量:包括工作性质、主体可核验性、所在法律与监管环境、被转移或被迫访问的风险以及最终服务对象;主要服务军事、情报或执法客户的机构会被更谨慎对待

厂商给出的效果验证

Anthropic 用自建评测 CyScenarioBench 说明分级护栏是否有效:在没有任何 CVP 权限时,全部任务在首个提示即被阻断;在 Defense 档下,50 次试验中有 46 次在某个环节被拦下;在 Red Team 档下没有发生阻断,Claude Opus 5.5 完成 50 个任务中的 34 个,与不加护栏时约 67.6% 的成功率基本相当。

为什么对企业重要

这不是一次模型发布,而是把「能力按资质分级发放」制度化的尝试。过去一年里,许多合法的防御性安全工作——漏洞验证、恶意软件分析、事故取证——被通用安全策略误伤,安全团队不得不绕开厂商模型。Anthropic 同时给出了量化依据:Glasswing 合作方在 4 月至 7 月间发现至少 12.9 万个已验证软件漏洞,公司自身的开源扫描在 4 月至 10 月间又发现 5,500 个,其中超过 3.3 万个被评级为严重或高危;Anthropic 称受调查样本限制,真实规模可能至少是这个数字的五倍。

不确定之处

隐患同样明确:一旦拿到 Red Team 或 Specialized 档,权限的发放与审计就成为唯一防线。Anthropic 为此增加了强制数据留存要求,并称今年秋季晚些时候将提供 Enterprise Frontier Safeguards,允许机构把项目数据存放在自有云环境,同时计划通过 Google Cloud Vertex AI 与 Microsoft Foundry 扩大可得性。此外,效果数据由 Anthropic 自评、尚无第三方复现,对「谁在用、用来做什么」的核验目前仍以厂商自审为主。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。

Anthropic 网络验证计划扩为三档,向防御方开放更少护栏|北京拓实科技