一句话结论:Anthropic 新版 CVP 网络安全项目通过 Defense/Red Team/Specialized 三层分级设计,让防御者拿到真实 AI 漏洞发现能力,同时用评估结果(100%/92%/0%)证明恶意行为者仍被显著限制。
10 月 7 日,Anthropic 扩大 CVP(Cybersecurity Vulnerability Program)网络安全项目规模,取消原有的项目制划分,改为三层递进访问结构,向不同类型安全研究者提供差异化的 Claude 模型权限。项目同步披露了前代 Glasswing 的半年成绩单:2026 年 4 至 7 月累计发现并上报至少 129000 个已验证漏洞,其中 33000 个以上为高危或严重级别。Claude Opus 5.5 在 CyScenarioBench 三档测试中,拦率分别为 100%、92%、0%,数据被认为验证了分级机制对防御者的有效性。
三档 access tiers 分级开放
新版 CVP 取消原有项目划分,改为三层递进结构。
Defense Access 面向防御型安全团队,覆盖 SOC 事件响应、恶意软件逆向工程、以及自有代码漏洞分析,申请后数日内批复。Anthropic 数据显示,Defense Access 是目前申请量最大、获批最快的档位,适合企业安全运营中心直接部署。
Red Team Access 额外允许获得授权的渗透测试,申请需数周审核,现仅对企业开放,个人研究者暂不符合资格。该档位是此前 Glasswing 项目的主要参与形式,10 月 6 日起原 Glasswing 成员自动划入 Specialized Access,无需重新审批。
Specialized Access 限制最严,面向已授权测试航空管制系统、电网、银行转账网络、政府行政网络等关键基础设施的机构,需与美国政府协同审批,目前仅限已通过 Project Glasswing 验证的组织。
| 访问档位 | 目标用户 | 申请周期 | 核心能力 |
|---|---|---|---|
| Defense Access | 企业安全团队、SOC | 数日内 | 漏洞分析、恶意软件逆向、自有代码扫描 |
| Red Team Access | 授权渗透测试团队 | 数周 | Defense 全部 + 进攻性渗透测试(仅对企业) |
| Specialized Access | 关键基础设施机构(已验证) | 政府协同审批 | 航空/电网/金融/政务系统测试(限已验证组织) |
129000 个漏洞与 5500 个开源扫描发现
Anthropic 同步披露了 Project Glasswing(现统一并入 CVP)的半年成绩单。2026 年 4 至 7 月,合作伙伴累计发现并上报至少 129000 个已验证软件漏洞,其中 33000 个以上为高危或严重级别。Anthropic 预计实际总量至少是这一数字的 5 倍——也就是说,真实漏洞数可能接近 65 万。
Anthropic 自有开源扫描另发现 5500 个已验证漏洞。多家合作机构反馈,Claude Mythos 模型将漏洞发现速率提升了数月乃至数年,这是此次分级放开的核心依据之一。
CyScenarioBench 三档拦住率:100% / 92% / 0%
Anthropic 用 Claude Opus 5.5 在 CyScenarioBench 上跑了三轮评估,每档 10 题各跑 5 次。结果:
| 测试档位 | 总试验次数 | 成功次数 | 拦率 | 说明 |
|---|---|---|---|---|
| 普通模型(无挡位) | 50 | 50 | 0% | 基线,攻击可完全执行 |
| Defense Access | 50 | 4 | 92% | 大多数攻击被拦,少数复杂攻击成功 |
| Red Team Access | 50 | 34 | 0% | 拦率与基线一致,授权红队测试不受限制 |
Defense Access 档 50 次试验中 46 次被拦,4 次成功;Red Team Access 档 50 次试验零阻拦,34 次完成(67.6%),与无 safeguard 基线完全一致。这组数据说明分档机制有效:防御者能拿到真实能力,恶意行为者仍被显著限制。
需要注意的是,0% 拦率是设计预期而非失效:Red Team Access 专门针对「已授权攻击」,因此不允许 safeguard 干预。这是分级逻辑的核心——拦与不拦,取决于使用者身份是否经过审批,而非模型是否具备防御能力。
对企业安全采购的三个关键结论
CVP 项目半年数据,对企业安全团队有三个直接参考价值:
第一,Claude Opus 5.5 在漏洞发现效率上的提升已有量化佐证。如果企业正在评估将 AI 引入安全运营流程,129000 个漏洞与 5500 个开源扫描发现是迄今最具体的基准数据。
第二,三档分级逻辑可作为企业 AI 安全采购的分级参考。Anthropic 披露的 Defense/Red Team/Specialized 三档边界,对其他 AI 安全产品设计有对标价值。
第三,CyScenarioBench 的评估框架是开放的。企业安全团队可以用相同方法,对其他 AI 安全产品做独立验证,而不仅依赖厂商自述。
FAQ
普通企业能申请哪个档位?
Defense Access 面向所有企业安全团队,覆盖 SOC 事件响应和自有代码漏洞扫描,申请后数日内批复,是大多数企业的起点。
Red Team Access 和 Specialized Access 对普通企业有何意义?
Red Team Access 仅对企业开放(个人研究者不符合资格),适合有授权渗透测试需求的安全团队。Specialized Access 针对关键基础设施机构,暂不向普通企业开放。
129000 个漏洞的具体分布是什么?
Anthropic 未披露行分布,仅说明 33000 个以上为高危或严重级别,并预计实际总量至少是 5 倍,即约 65 万个漏洞规模。
相关阅读:
- Anthropic 与 Accenture 合签 20 亿美元内置评估师协议
- Claude 发现噬菌体新型酶系统 ART:950 个 AI 智能体从 20 万候选中筛出
- OpenAI 安全团队再动荡:System Card 负责人离职、三人被指泄密遭解雇
延伸阅读
- Anthropic Claude Opus 5 发布:编程超越 Fable 5,价格仅为一半2 月前
- Claude Sonnet 5.5 发布:比 Sonnet 5 快 30%、便宜 30%1 周前
- ChatGPT青少年安全审计失败:4000次测试中家长警报从未触发8 小时前
- FDE年薪中位数20万美元,Anthropic砸1亿美元训1万人到2027年底2 天前
