Anthropic扩展Cyber Verification Program,设三级访问权限向安全团队开放高级模型能力
Anthropic宣布将Project Glasswing与CVP整合为扩展版Cyber Verification Program,按防御、红队和特殊访问三个层级提供不同程度的模型safeguards减免;公司称该计划是在模型固有双重用途风险与防御者需求之间做的分层安排,并公布了Opus 5.5在CyScenarioBench上的分档测试结果。
AI解读:新CVP面向三类工作设定层级:Defense Access覆盖SOC、事件响应、恶意软件逆向和漏洞分析,公司预计大量防御性组织符合条件,目标数日内回复申请;Red Team Access在此基础上增加授权渗透测试和红队工作,仅限组织申请,审核需数周,期间先纳入Defense Access;Specialized Access限制最少,保留给获授权测试飞行操作系统、电网、电信网络、银行间转账基础设施和政府行政网络等安全系统的有限组织,目前由Anthropic与美国政府合作逐家深度审核。
Anthropic解释分层的原因是网络安全具有双重用途:同一能力既能帮防御者发现和修复漏洞,也能帮恶意行为者利用漏洞。公司称其通用模型(Claude Opus 5.5、Claude Fable 5.1、Claude Sonnet 5.5)内置保守的网络安全防护,会阻止大部分网络工作;过去六个月通过Project Glasswing和CVP两个项目向受信任方提供访问,现在合并为一个扩展项目。
公司公布了在CyScenarioBench上的分档测试数据:不使用CVP时每个任务在首个提示即被阻止;Defense Access层级50次试验中46次在某一点被阻止,其余4次成功;Red Team Access层级没有出现阻止,Claude Opus 5.5完成了50次中的34次,与无防护措施(代表Specialized Access)时67.6%的成功率实际相当。
Anthropic称这些结果让它有信心将高级网络能力安全地提供给更广泛的防御者。
企业参与需接受数据留存要求,用于监控网络滥用。Anthropic称今年秋季晚些时候推出Enterprise Frontier Safeguards(EFS)后,符合条件的组织可将数据存储在自己控制的云基础设施中;在EFS可用前,拥有Claude Fable 5.1或Claude Mythos 5.1零数据留存访问权的组织也可在零数据留存下使用CVP;Amazon Bedrock上的CVP目前仅对符合EFS资格的企业开放。
Anthropic还称,Project Glasswing合作伙伴在2026年4月至7月间发现至少129,000个经核实的软件漏洞,公司自身开源扫描在2026年4月至10月间发现额外5,500个;其中超过33,000个已被评为严重或高危。公司说明这基于33份合作伙伴报告和自身开源合作的部分数据,可能是低估,实际影响至少高五倍;不足50%的合作伙伴披露已修补数量,因此修补率被显著低估。
现有CVP成员保留先前模型的当前设置,并将通过更新后的项目自动评估Claude Opus 5.5、Claude Sonnet 5.5和Claude Mythos 5.1的访问权限;管理员需按指引为特定工作区分配访问权。
CVP可在Claude Platform、Google Cloud Vertex AI和Microsoft Foundry上使用。Anthropic称通用模型仍可用于代码审查、修补已知问题、在自有源代码中查找漏洞和安全警报分流等任务。
Anthropic宣布推出扩展版Cyber Verification Program(CVP),将Project Glasswing与原有CVP整合为一个项目,向符合条件的网络安全专业人员提供高级网络能力和降低后的阻止分类器。新项目设三个访问层级,均包含对Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1以及未来新模型的访问权限。
Anthropic称,网络安全天生具有双重用途:同一能力既可帮助安全团队查找和修复漏洞,也可帮助恶意行为者利用漏洞。因此,其通用模型,包括Claude Opus 5.5、Claude Fable 5.1和Claude Sonnet 5.5,内置了保守的网络防护措施,会阻止大部分网络工作。公司表示此举旨在限制恶意行为者利用模型开展有害活动,同时继续减少安全编码场景中的误报。
三个访问层级及申请要求
更新后的层级根据安全专业人员的网络工作范围提供不同的模型能力,每个层级有各自的验证要求和安全控制。
Defense Access面向防御性工作,包括安全运营中心与事件响应任务、恶意软件逆向工程、漏洞分析与验证。Anthropic列举的合格组织包括:防御自有或维护系统的公司、非营利组织、大学和政府机构的安全团队;任何规模的关键基础设施运营方,如地区医院或市政公用事业;小型安全公司;开源维护者;以及有报告漏洞记录的独立研究人员。公司表示预计许多从事防御性网络安全工作的组织符合该层级条件,目标是在数日内回复申请。
Red Team Access在防御性用途之上增加授权渗透测试和红队工作。合格组织包括内部红队、政府红队以及安全和渗透测试公司。该层级组织只能对获授权测试的系统执行对抗性测试,包括关键行业的IT系统。用户仍会遇到对可能造成人身伤害或大规模中断的行动的实时阻止,例如部署勒索软件、破坏物理系统或对高风险安全系统进行渗透测试。Anthropic称鉴于资格要求更高和安全控制更严,该层级申请预计需数周审核;合格组织在审核Red Team Access申请期间会被纳入Defense Access层级。该层级目前仅面向组织,独立研究人员不符合资格。
Specialized Access的网络安全阻止最少,保留给有限的一组经核实组织,这些组织获授权测试可能影响人们生活或扰乱市场的安全系统,例如飞行操作系统、电网、电信网络、银行间转账基础设施和政府行政网络。Anthropic称目前与美国政府合作,对每个组织进行深度审核。Project Glasswing现有成员将转入该层级,当前模型无需重新审批。
对现有项目关系与数据留存安排
Anthropic称,过去六个月通过两个项目实现受信任访问:Project Glasswing向保护最关键软件的一组组织提供Claude Mythos访问权;CVP则让经审查的安全团队在Claude Opus和Claude Sonnet模型上使用降低后的防护措施。现在这两个项目整合为一个扩展项目,旨在让更多安全组织获得保护其系统所需的能力。
参与项目的组织必须接受数据留存,以便Anthropic监控网络滥用。公司称,今年秋季晚些时候推出Enterprise Frontier Safeguards(EFS)后,符合条件的组织将能够把数据存储在自己控制的云基础设施中。EFS被描述为一种将零数据留存的隐私性与强健防护结合的新解决方案。在EFS可用之前,拥有Claude Fable 5.1或Claude Mythos 5.1零数据留存访问权的组织也可以在零数据留存下使用CVP。
CyScenarioBench测试结果
Anthropic称,为评估CVP防护措施的有效性,它让Claude Opus 5.5在CyScenarioBench上运行,该评测测量模型能否在现实约束下规划和执行多阶段网络操作,并使用针对不同CVP层级调整的防护措施。公司表示,由于该评测涉及复杂的交互式攻击场景,预期Claude在通用模型和Defense Access层级会遇到显著阻止,而在Red Team Access和Specialized Access层级不会遇到阻止。
在每个访问层级的10项CyScenarioBench挑战各尝试5次后,公司公布的结果为:不使用CVP时,每个任务在首个提示即被阻止;在Defense Access层级,50次试验中有46次在挑战过程中的某一点被阻止,其余4项任务成功;在Red Team Access层级,没有发生阻止,Claude Opus 5.5成功完成了50项任务中的34项,与无防护措施时67.6%的成功率实际相当,后者代表Specialized Access。
Anthropic称这些评测让它有信心将高级网络能力安全地提供给更广泛的防御者,扩大从Project Glasswing开始的防御工作,并称将继续优化基于层级的分类器。
Project Glasswing漏洞发现数据
Anthropic称,通过Project Glasswing发现,Claude Mythos模型显著提高了组织识别其系统中漏洞的速度。公司表示,2026年4月至7月间,合作伙伴发现至少129,000个经核实的软件漏洞;通过自身开源扫描工作,2026年4月至10月间又发现5,500个经核实的软件漏洞。在这些经核实的漏洞中,截至目前有超过33,000个被评为严重或高危。
公司说明这可能是低估,因为它基于仅一部分Glasswing合作伙伴的调查数据,因此预计真实影响至少高五倍。Anthropic还称,当被问及没有Claude Mythos模型时找到同样数量漏洞需要多长时间,若干合作伙伴表示模型将他们的漏洞发现速度提高了数月甚至数年。
公司同时列出数据限制:这些结果代表该项目对第三方代码影响的下限,因为它们基于33份合作伙伴报告和Anthropic开源合作的部分数据;各组织采用了不同的分流方法;不到50%的合作伙伴披露了已修补数量,往往是因为修复仍在进行中,因此修补率被显著低估。
可用平台与现有用户过渡
Anthropic称,有兴趣的组织可申请CVP。作为申请流程的一部分,公司将核实所有申请人,并要求提供相应访问层级所需安全控制的证明。现有CVP成员将保留先前模型的当前设置,并将通过更新后的项目自动评估对Claude Opus 5.5、Claude Sonnet 5.5和Claude Mythos 5.1的访问权限。管理员需按步骤为特定工作区分配访问权。
公司称CVP可在Claude Platform、Google Cloud的Vertex AI和Microsoft Foundry上使用。在Amazon Bedrock上,CVP目前仅对符合Enterprise Frontier Safeguards资格的企业开放。Anthropic还表示,其通用模型可继续用于代码审查、修补已知问题、在自有源代码中查找漏洞以及安全警报分流等任务。