Anthropic新版CVP:三层分级访问权限,129000个漏洞

一句话结论:Anthropic 新版 CVP 网络安全项目通过 Defense/Red Team/Specialized 三层分级设计,让防御者拿到真实 AI 漏洞发现能力,同时用评估结果(100%/92%/0%)证明恶意行为者仍被显著限制。

10 月 7 日,Anthropic 扩大 CVP(Cybersecurity Vulnerability Program)网络安全项目规模,取消原有的项目制划分,改为三层递进访问结构,向不同类型安全研究者提供差异化的 Claude 模型权限。项目同步披露了前代 Glasswing 的半年成绩单:2026 年 4 至 7 月累计发现并上报至少 129000 个已验证漏洞,其中 33000 个以上为高危或严重级别。Claude Opus 5.5 在 CyScenarioBench 三档测试中,拦率分别为 100%、92%、0%,数据被认为验证了分级机制对防御者的有效性。

三档 access tiers 分级开放

新版 CVP 取消原有项目划分,改为三层递进结构。

Defense Access 面向防御型安全团队,覆盖 SOC 事件响应、恶意软件逆向工程、以及自有代码漏洞分析,申请后数日内批复。Anthropic 数据显示,Defense Access 是目前申请量最大、获批最快的档位,适合企业安全运营中心直接部署。

Red Team Access 额外允许获得授权的渗透测试,申请需数周审核,现仅对企业开放,个人研究者暂不符合资格。该档位是此前 Glasswing 项目的主要参与形式,10 月 6 日起原 Glasswing 成员自动划入 Specialized Access,无需重新审批。

Specialized Access 限制最严,面向已授权测试航空管制系统、电网、银行转账网络、政府行政网络等关键基础设施的机构,需与美国政府协同审批,目前仅限已通过 Project Glasswing 验证的组织。

访问档位 目标用户 申请周期 核心能力
Defense Access 企业安全团队、SOC 数日内 漏洞分析、恶意软件逆向、自有代码扫描
Red Team Access 授权渗透测试团队 数周 Defense 全部 + 进攻性渗透测试(仅对企业)
Specialized Access 关键基础设施机构(已验证) 政府协同审批 航空/电网/金融/政务系统测试(限已验证组织)

129000 个漏洞与 5500 个开源扫描发现

Anthropic 同步披露了 Project Glasswing(现统一并入 CVP)的半年成绩单。2026 年 4 至 7 月,合作伙伴累计发现并上报至少 129000 个已验证软件漏洞,其中 33000 个以上为高危或严重级别。Anthropic 预计实际总量至少是这一数字的 5 倍——也就是说,真实漏洞数可能接近 65 万。

Anthropic 自有开源扫描另发现 5500 个已验证漏洞。多家合作机构反馈,Claude Mythos 模型将漏洞发现速率提升了数月乃至数年,这是此次分级放开的核心依据之一。

CyScenarioBench 三档拦住率:100% / 92% / 0%

Anthropic 用 Claude Opus 5.5 在 CyScenarioBench 上跑了三轮评估,每档 10 题各跑 5 次。结果:

测试档位 总试验次数 成功次数 拦率 说明
普通模型(无挡位) 50 50 0% 基线,攻击可完全执行
Defense Access 50 4 92% 大多数攻击被拦,少数复杂攻击成功
Red Team Access 50 34 0% 拦率与基线一致,授权红队测试不受限制

Defense Access 档 50 次试验中 46 次被拦,4 次成功;Red Team Access 档 50 次试验零阻拦,34 次完成(67.6%),与无 safeguard 基线完全一致。这组数据说明分档机制有效:防御者能拿到真实能力,恶意行为者仍被显著限制。

需要注意的是,0% 拦率是设计预期而非失效:Red Team Access 专门针对「已授权攻击」,因此不允许 safeguard 干预。这是分级逻辑的核心——拦与不拦,取决于使用者身份是否经过审批,而非模型是否具备防御能力。

对企业安全采购的三个关键结论

CVP 项目半年数据,对企业安全团队有三个直接参考价值:

第一,Claude Opus 5.5 在漏洞发现效率上的提升已有量化佐证。如果企业正在评估将 AI 引入安全运营流程,129000 个漏洞与 5500 个开源扫描发现是迄今最具体的基准数据。

第二,三档分级逻辑可作为企业 AI 安全采购的分级参考。Anthropic 披露的 Defense/Red Team/Specialized 三档边界,对其他 AI 安全产品设计有对标价值。

第三,CyScenarioBench 的评估框架是开放的。企业安全团队可以用相同方法,对其他 AI 安全产品做独立验证,而不仅依赖厂商自述。

FAQ

普通企业能申请哪个档位?
Defense Access 面向所有企业安全团队,覆盖 SOC 事件响应和自有代码漏洞扫描,申请后数日内批复,是大多数企业的起点。

Red Team Access 和 Specialized Access 对普通企业有何意义?
Red Team Access 仅对企业开放(个人研究者不符合资格),适合有授权渗透测试需求的安全团队。Specialized Access 针对关键基础设施机构,暂不向普通企业开放。

129000 个漏洞的具体分布是什么?
Anthropic 未披露行分布,仅说明 33000 个以上为高危或严重级别,并预计实际总量至少是 5 倍,即约 65 万个漏洞规模。

相关阅读: