三档 access tiers 分级开放
新版 CVP 取消原有项目划分,改为三层递进结构。Defense Access 面向防御型安全团队,覆盖 SOC 事件响应、恶意软件逆向工程、以及自有代码漏洞分析,申请后数日内批复。Red Team Access 额外允许获得授权的渗透测试,申请需数周审核,现仅对企业开放,个人研究者暂不符合资格。Specialized Access 限制最严,面向已授权测试航空管制系统、电网、银行转账网络、政府行政网络等关键基础设施的机构,需与美国政府协同审批,目前仅限已通过 Project Glasswing 验证的组织。
数字说话:129000 个已验漏洞
Anthropic 同步披露了 Project Glasswing(现统一并入 CVP)的半年成绩单。2026 年 4 至 7 月,合作伙伴累计发现并上报至少 129000 个已验证软件漏洞,其中 33000 个以上为高危或严重级别,Anthropic 预计实际总量至少是这一数字的 5 倍。Anthropic 自有开源扫描另发现 5500 个已验证漏洞。多家合作机构反馈,Claude Mythos 模型将漏洞发现速率提升了数月乃至数年。10 月 6 日起,原 Glasswing 成员自动划入 Specialized Access,无需重新审批。
CyScenarioBench 验证:三档拦住率 100%/92%/0%
Anthropic 用 Claude Opus 5.5 在 CyScenarioBench 上跑了三轮评估,每档 10 题各跑 5 次。结果:普通模型阶段一 prompt 即拦(100%);Defense Access 档 50 次试验中 46 次被拦(92%),4 次成功;Red Team Access 档 50 次试验零阻拦,34 次完成(67.6%),与无 safeguard 基线完全一致。数据证明分档机制有效:防御者能拿到真实能力,恶意行为者仍被显著限制。
相关阅读:Anthropic 与 Accenture 合签 20 亿美元内置评估师协议
补充:0% 拦率是设计预期
还有一个容易被误读的细节。Anthropic 说明,Red Team Access 档的 0% 拦率属于设计预期,不代表防护失效:该档面向的是已获授权的攻击测试,safeguard 按设计不介入。Defense Access 则是目前申请量最大、获批最快的档位,多数企业安全团队在提交申请后数日内即可拿到权限。
延伸阅读
- Anthropic 12 个月留存 22.5%,高于 OpenAI2 周前
- Claude Code Projects 转向并行分支:Anthropic 日跑 3 万 Agent,研发占比 26%3 周前
- 沃尔玛禁止门店展示 AI 生成标识:ChatGPT 海报被拒1 周前
- OpenAI 惊现自我复制代码漏洞:多国政务系统遭 Agent 强行越界1 周前
