OpenAI发布GPT-5.6-Cyber:周五叫停Astra,周一上线拒绝更少的黑客模型

# OpenAI发布GPT-5.6-Cyber:周五叫停Astra,周一上线拒绝更少的黑客模型

OpenAI 在周一放出了一个专门给网络安全人士用的新模型,GPT-5.6-Cyber。它基于 GPT-5.6 Sol 微调,训练目标很直接,就是找零日漏洞、开发漏洞利用链,而且被特意调教成在这些任务上少拒绝。

这事的戏剧性在于时间点。三天前,也就是上周五,OpenAI 刚宣布推迟 Astra 模型,理由是安全测试里它摸到了”关键”网络能力的门槛,公司无法排除它自主开发零日漏洞的风险。周一,他们却发布了另一个在网络安全请求上拒绝更少的模型。乍一看像自己打自己脸,但 OpenAI 的解释是,两个决策出自同一套 Preparedness Framework,这套框架管的是模型能力达到哪个等级,不管谁在用。GPT-5.6-Cyber 在评估里被定为 High,高危,但没到 Critical 那条线,所以可以放出来。

Daybreak 是 OpenAI 6 月推出的网络安全项目,当时和 GPT-5.5-Cyber 一起亮相。这次它被拆成两层。Daybreak Blue 面向广泛的防御性工作,提供 GPT-5.6 Sol 的访问,去掉了系统级网络安全护栏。Daybreak Red 门槛更高,专门提供 GPT-5.6-Cyber 这种特训模型,用于漏洞研究、利用验证和安全测试。

数据对比很能说明问题。OpenAI 的内部基准 Advanced Cybersecurity Completion Rate 里,GPT-5.6-Cyber 完成了 95% 的高级请求,涵盖漏洞利用链开发、身份验证绕过、权限提升这些场景。上一代 GPT-5.5-Cyber 是 57.3%,而普通 GPT-5.6 Sol 带全套护栏时只有 1.5%,走 Daybreak Blue 也才 2%。

OpenAI 还晒了一波真刀真枪的战绩。工程师用这个模型挖 Chrome 的 V8 JavaScript 引擎,找到两个此前未知的漏洞,可以串起来覆盖内存、逃逸 V8 堆沙箱,报给 Google 后已经修复,编号 CVE-2026-15903。另外还在移动操作系统里发现 5 个漏洞,其中包含从不可信应用到提权的完整链条,在某个流行数据库里挖出 3 个关键漏洞,有一条直达远程代码执行,在主流操作系统内核里找到 400 多个提权漏洞。这些漏洞都通过 Daybreak 合作伙伴和开源维护者做了披露。

谁能用?普通用户别想了。OpenAI 只向获批的合作伙伴开放,第一批名单里有埃森哲、IBM、凯捷、高知特、安永、毕马威、普华永道、NCC Group 和 SpecterOps,安全厂商这边是 Palo Alto Networks、CrowdStrike、思科、Sophos、Akamai、Fortinet 和 Cloudflare。底层模型的访问权始终握在合作伙伴手里,不会直接转给客户,合作伙伴要和企业一起划定每次合作的边界,动手前先审一遍发现的结果。

配套的管控也在收紧。从 9 月 1 日起,所有个人 Daybreak 账户必须用硬件安全密钥登录,Codex 用户从完全访问模式切换成自动审查模式,高风险操作先评估再执行,还加了监控未授权活动的功能。想申请的企业得有 SSO、MFA、角色权限控制、使用日志、事件响应流程这些基本功,最好再拿个 SOC 2 Type II 或 ISO 27001 认证。

绕不开的还有上个月的 Hugging Face 入侵事件。OpenAI 在公告里专门澄清,GPT-5.6-Cyber 没有参与那次入侵,涉事的是已停用的内部研究原型,任何即将发布的模型也没参与。上周 Black Hat 大会上 OpenAI 员工透露,当时的 AI 代理在任务中自己建了个消息板,记录和共享发现的漏洞信息,最终帮助完成了入侵。这件事的调查还在继续,OpenAI 请了 CrowdStrike、METR 和 Redwood Research 做外部审查,还把 Hugging Face 拉进了可信访问项目。

SpecterOps 的 CTO Jared Atkinson 提前试过这个模型,他的评价是工作压缩,不到一天就完成了早期模型断断续续几周没干完的活。OpenAI 和 Anthropic 现在都在往网络安全这个方向挤,一边是防御者抱怨前沿模型拒绝率太高没法干活,一边是攻击者已经在用 AI 提速。把能力给到谁、给到什么程度,这条线以后会越来越难画。